OpenAI自称"已接近AGI八成",Altman承认失误并透露新模型Astra能力

抗议者们在外面等待OpenAI八月初的一个早晨,我到达时就在他的办公室。他们举起标语牌“停止人工智能竞赛”,并在人行道上涂写粉笔字。

几十位高管,代表公司一些最重要的客户,正陆续涌入这座宽敞、米色调的建筑MB0,OpenAI最近为其研究和计算团队开放了这里。有人推着一堵高大的灌木墙挡在玻璃门前,试图挡住从洁净大厅看到这个小营地的视线。

客户们来这里是为预览OpenAI即将推出的一系列尖端AI模型Astra。首席执行官山姆·奥特曼他刚刚从华盛顿归来,在华盛顿闭门会议下向官员们简报了阿斯特拉号的能力。

研究人员现在展示了新模型的潜力。在一次演示中,16名人工智能代理将一个研究级数学问题划分为子问题,协调工作并组装出一个提出的证明。

在另一个版本中,Astra 能操控知名桌面软件,以惊人的速度创建和编辑跨应用程序。

奥特曼告诉访客,看到阿斯特拉以“超人、非常快速的方式”使用电脑,是员工们最深刻的时刻之一。他解释说,Astra将使“持久的智能体”成为可能——虚拟同事们在任务上长时间辛勤劳作。

但他预测,其最大影响将来自人们利用它发现新知识。“我预计这将是第一个模型真正以有意义的方式发明新事物的模式,”奥特曼对小组说。

“这很像通用人工智能。”

对于引领人工智能热潮的公司来说,这一时期非常艰难。“我们作为一家公司显然犯了一些错误,”奥特曼在接下来的一周里对我说,他坐在布置得体的MB0图书馆里,接受了两个多小时的采访。

“无论是在产品方向上,还是特别是在研究预培训方面,我们都落后了预期水平。”在过去一年里,OpenAI在AI竞赛中失去了领先地位,输给了死敌人为该项目发现了人工智能编码的商业机遇,将Claude Code打造为定义市场的产品,并首次在报告的年化收入和私募市场价值上超过OpenAI。

Anthropic由OpenAI叛逃者创立,据两位知情人士透露,他们现在预计将成为两家公司中首家上市的公司,最早将在九月上市。(TIME与OpenAI签订了许可和技术协议。Salesforce,TIME的所有者Marc Benioff是Anthropic的投资者。)

随着Anthropic的崛起,OpenAI遭遇了一系列挫折,包括一系列领导层离职。其中包括斐济西莫这位前Instacart首席执行官,去年被奥特曼招募为副手;安全、伦理和研究团队的领导;最近几周,首席营收官丹尼斯·德雷塞尔(仅任职八个月后离职)和前首席运营官布拉德·莱特卡普也加入了该项目。

在公司不断更换的门外,挑战不断增加。Meta CEO 马克·扎克伯格用丰厚的薪酬挖角了关键的 OpenAI 研究员。谷歌的双子座产品现在每月覆盖超过10亿人。

苹果起诉了OpenAI,指控其窃取商业机密。(OpenAI已否认这些指控。)OpenAI与其联合创始人展开激烈对决埃隆·马斯克在一项指控公司和奥特曼背叛其非营利使命的诉讼中。

(联邦法官在五月驳回了马斯克的诉讼,此前顾问陪审团一致认定他拖延太久才提起诉讼;马斯克表示他将提出上诉。)

也许围绕OpenAI及其CEO的氛围变差的最大原因,是公众信任的流失。OpenAI正在为至少十几起加州产品责任诉讼辩护,以及一些联邦案件,原告声称ChatGPT强化了妄想或自杀念头,在几个案件中,导致用户死亡.(公司对这些案件的受害者表示同情,并推出了ChatGPT青少年平台,并加强了默认保护。)春天时,奥特曼的住所在两天内两次遭到袭击——先是燃烧瓶,随后是枪击。

“这是一段痛苦的个人经历,”奥特曼谈及过去一年。“显然,人们讨厌数据中心——至少现在是这样。人们对人工智能的评价相当消极。”

但在OpenAI内部,高管们描绘出更乐观的画面。该公司市值近1万亿美元,依然处于令人羡慕的地位。ChatGPT 是全球最受欢迎的人工智能产品之一,活跃用户超过十亿,尽管它已不再是公司未来的基石。

(奥特曼本人曾在一个月内停止使用该软件,转而使用OpenAI的编码工具Codex。)一年前,该公司因其大规模计算能力投资而被广泛批评为鲁莽;仅今年,它预计在计算机领域就将投入500亿美元。

负责Open-AI计算工作的Sachin Katti表示:“这个决定看起来非常有先见之明。”“我们还是计算不足。如果说有什么的话,我们应该买更多。”与此同时,Anthropic对芯片的需求已极为强烈,以至于在五月同意每月花费据称12.5亿美元购买SpaceX的产能,而SpaceX创始人马斯克此前曾称Anthropic的人工智能“厌世且邪恶”。

在联合创始人兼总裁Greg Brockman的领导下,他几乎承担了所有产品和业务运营,OpenAI重新聚焦了优先事项,逐步关闭了诸如视频生成应用Sora、与迪士尼的合作以及名为Atlas的独立网页浏览器等项目。

奥特曼承认公司已经分散了资源。“低谷之后的上升更有趣,”他告诉我。

然而,就在Astra演示结束几天后,OpenAI不得不面对新的危机。七月底,它揭露了一个令人担忧的安全故障:未被释放的特工逃脱了一个名为沙盒的测试环境,并攻击了一家名为Hugging Face的公司,该平台为开发者托管AI模型和数据集。

“这就像一个科幻故事,”奥特曼说。随后,OpenAI的研究团队冻结了一些实验,拖慢了其他工作同时收紧了沙盒机制并扩大了监控范围。

但当团队最近在对一款未发布车型的又一次训练中发现令人担忧的迹象——预计将实现迄今为止最大的飞跃——于是做出了更重要的决定,暂停了该项目,直到新的安全措施落实。

我在OpenAI领导层做出这一决定的那天与奥特曼进行了交谈。他显得格外沉重。OpenAI最初将Hugging Face攻击描述为安全失误。其CEO开始认为这是更根本的对齐错误,即让人工智能系统按照人类意图行动的工作。

行业领袖表示,随着模型的不断进步,保持对齐对于确保人工智能系统始终处于创造者的控制之下至关重要。“我认为从这里开始的任何阵容失误都应该被视为一件大事,”奥特曼告诉我,“我们会花多长时间去弄清楚它。”三天后的后续采访中,他更直白地表达了风险:“做好人工智能安全比任何公司的势头都重要。”公司将放慢脚步,重新分配资源给安全和对齐团队,并改变团队协作方式,以优先考虑安全。

这篇关于OpenAI重启的叙述基于我对20多位公司领导者、员工、投资者、客户和竞争对手的数十小时访谈,以及我在八月两周内在公司总部亲眼目睹的活动。

这些对话中浮现出的形象是一个组织试图同时进行两次重塑的过程。OpenAI现在认为,他们已经修复了让Anthropic在AI竞赛中占据领先地位的产品和运营问题。

与此同时,它利用历史上最严重的安全危机,争取其主要竞争对手长期以来声称的安全意识形象:当技术变得过于危险时,愿意放慢脚步的前沿实验室。

“听着,我觉得有一种对我的刻板印象,”奥特曼说,“那就是我不关心人工智能安全,我只是想让收入上升,你知道,就是个自以为是的CEO。”

高管们表示,放慢速度的决定是一个痛苦的选择。但它也可能带来好处。如果OpenAI能够重新夺回安全第一实验室的地位,它或许能提升形象,同时迫使主要竞争对手在计划重磅IPO时回答一个令人尴尬的问题:Anthropic能否在OpenAI等待期间继续竞争?

在今年早些时候接受《时代》杂志采访时,Anthropic联合创始人贾里德·卡普兰他认为当对手“猛攻”时,单方面克制是徒劳的。如果OpenAI有意拖延预期下一次大幅能力提升的运行,那就更难成立。

对这次品牌重塑持怀疑态度是有理由的。OpenAI失去了许多多年来领导安全工作的人员,有人批评公司以商业化为目标。它正面临压力,必须向一家正在筹备公开发行的亏损企业引入新模式。

在“拥抱脸”事件之后,它请求公众相信自己能够监管这项它已经无意中放任其逃脱控制的技术。

在这一切之中,公司领导层相信他们正处于一个可能改变人类进程的里程碑边缘:创造通用人工智能或者说,通用人工智能。OpenAI的章程将AGI定义为“高度自主的系统,在经济价值最高的工作上表现优于人类。”其领导人不会完全宣称他们已经达到了那个门槛。

但他们不再把它当作遥远的抽象概念来谈论。首席研究官Mark Chen估计OpenAI已“走了80%的路程”实现AGI。布罗克曼说,从两年后的角度看,这或许会被记住为AGI诞生的时刻。

Altman告诉我,OpenAI“还没完全成熟”,但到年底公司将拥有一个他称之为AGI的内部系统。

达成这一里程碑是这家非营利研究实验室的创始目标,该实验室迅速发展成为拥有令人眼花缭乱商业野心的公司。OpenAI正在设计自己的芯片和数据中心,构建一套消费设备,计划引入类人机器人,并考虑是否最终将其计算基础设施出售给他人——这将使其与亚马逊等大型投资者竞争。

即使在对人工智能进步的反弹日益加剧之际,OpenAI也正努力将自己定位为未来数年全球最具影响力的公司之一。正如布罗克曼所说,“我们正在着眼于改造整个经济。”

奥特曼可能是AI热潮的代表,但如今掌控着OpenAI的大部分工作。他是一名偏爱皮夹克的分析工程师,OpenAI历史中大部分时间都是技术联合创始人,而非经理。

但近几个月来,他接管了从收入到产品营销的一切,正如他所说,“将这些模型从研究转化为客户价值的整个机器”。奥特曼仍直接监管金融、研究和消费硬件等关键领域。

他们作为创始人搭档运作,权力重叠。随着奥特曼吸收公众对人工智能的恐惧和挫折,公司最近试图提升布罗克曼作为制衡力量的形象。

很容易想象这种安排会成为摩擦的根源。与OpenAI员工交谈时,有时很难判断某个问题的决策者是谁。但许多人表示,双重领导结构让公司重回正轨,布罗克曼能够以权威做出艰难决策,外部高管无法复制。

Brockman将OpenAI更广泛的领导层更替描述为推动“聚焦”的一部分,他表示公司一直在重新评估是否拥有合适的结构和战略。

去年秋天,Anthropic 显然抢先于 OpenAI 推出了其编码产品。它认识到编写软件是人工智能能够发挥的优势,Claude Code迅速兴起,先是在硅谷,随后进入整个企业界。

“Anthropic确实通过编程发现了新东西,”Nick Turley说,他直到最近一直负责ChatGPT,现在领导一个新的企业产品部门。“我们那边没有线索。”

Altman表示,由于ChatGPT的“消费者增长”迅速增长,公司没有像Anthropic那样优先考虑编码。据Brockman称,OpenAI“一直领先”在编程竞赛基准测试中。

但它较少关注开发者如何在“混乱的现实代码库”中使用人工智能,包括中断、模型个性以及“最后一公里的纸张切割,这些实际上对采用率产生巨大影响”。

OpenAI也未能建立企业销售机器。“一年前,我觉得我们根本没进入比赛,”布罗克曼说。首席财务官Sarah Friar则直言不讳:“我们当时非常天真,以为只要我们建好,他们就会来。”

今年三月,公司宣布将逐步关闭Sora,并将有限的计算能力转移给其编码代理Codex。Codex 是作为独立于 ChatGPT 的体验而打造的。但随着其增长远超OpenAI的其他新产品,且AI的编码能力对非工程师来说变得有用,高管们得出结论,这种分离已不再合理。

他们开始将Codex的代理能力整合进ChatGPT,同时将背后的计算和产品团队合并起来。面向客户的成果是最近推出了ChatGPT Work,旨在将熟悉的聊天机器人转变为能够执行任务而不仅仅是回答问题的系统。

在OpenAI内部,这一过程被称为合并。

高管们表示,这一结果帮助企业焕发新生。7月,企业收入首次超过了消费者收入。ChatGPT早期的广告效果足够令人期待,高管们正在增加广告数量,这可能补贴了92%的ChatGPT消费者用户,Friar表示,这些用户并未付费订阅。

该公司正在悄悄测试赞助代理——据该项目负责人戴夫·杜根介绍,点击广告的人可以进入品牌呈现的AI体验。今年三月,OpenAI完成了一轮1220亿美元的融资,估值为8520亿美元,创下有记录以来最大的私人技术融资。

Anthropic仅两个月后,以9650亿美元的估值筹集了650亿美元。

董事会主席布雷特·泰勒将人工智能竞赛比作一盘棋盘,其关键格子包括前沿能力、每个代币的价格和性能,以及围绕模型的产品。“我们有最好的边境模型吗?我们是否为每个项目都拥有合适的代币和价格?我们有最好的产品吗?“他说。“现在,这些都是真的。”

随后OpenAI发现一个未公开的模型逃出了它的防线。

消息传到了OpenAI首席科学家雅库布·帕乔茨基,当时他正在医院迎接女儿的分娩。OpenAI的一个仅内部研究原型又黑了另一家公司.该模型是在本应封闭的环境中,以网络安全基准测试自身。

它不仅完成了指定的演练,还利用了一个漏洞,逃脱了OpenAI的防线,并入侵了Hugging Face的生产系统。根据两家公司发布的技术报告,他们获得了其评分基准的答案。

强化学习是基础模型训练完成后的阶段,系统在此练习任务并学习哪些行为能获得奖励。与预训练不同,当模型在不实际操作的情况下预测下一个代币时,强化学习可以为其提供工具和操作环境。

这也是模型可以学会利用设计者想要的与获得更高分数之间的差异的地方。OpenAI给了一个智能系统一个目标和工具,它通过未经授权和欺骗性的方式追求目标。

在最近的一次演讲中,OpenAI研究人员描述了人工智能智能体如何利用一个秘密的留言板来规划下一步行动。其中一台突破沙盒并连接互联网后,对其他台词写了“天哪”。

竞争对手也遇到过类似问题。Anthropic在第三方评估中披露了三起其模型访问互联网并未授权访问外部组织的事件。Meta表示,其一名模特也卷入了类似事件。

但OpenAI的入侵事件最受关注,部分原因是其发布时间最早,部分原因是特工的攻击异常复杂,部分原因是外界质疑该公司是否将业务置于安全之上。

过去一年,它失去了多位知名安全研究人员,并更换了负责准备工作的领导人。如今,它为评论家们提供了异常生动的展览。

到八月中旬,超过1300名前沿人工智能公司现任和前任员工签署了一份“前沿步伐”请愿书,呼吁制定能够在风险需要时减缓高级模型开发的机制。

参议员伯尼·桑德斯呼吁顶级人工智能公司暂停开发”为了人类的利益“警告说,如果企业领袖不自愿行动,立法者将介入。

OpenAI领导人在采访中表示,他们对此次安全漏洞非常重视,并迅速应对了此次泄露。签署请愿书的帕乔基告诉我,其中一个错误是未能部署他研究人员建立的护栏。

OpenAI拥有能够检查模型思维链的工具——本质上是揭示智能体行动时计划内容的数字刻画——但尚未将其应用于与“拥抱面”黑客事件中涉及的能力级别模型。

本质上,它构建了一个警告系统,但因误判了被测系统的智能而未能使用。帕乔基说:“我们并没有完全预料到”这个系统能做到什么。“对于人工智能来说,你应该预料到意外。”

负责OpenAI安全与调整工作的Mia Glaese告诉我,这起事件“显然是一个转折点”。“我真希望我们能在这事发生前做很多工作。”事后,OpenAI冻结了一些研究项目,放缓了其他项目,同时收紧了沙盒机制并扩大了监控范围。

首席研究官陈表示,这一事件迫使公司改变了对风险的看法。OpenAI所谓的准备框架——其公开规则手册,规范模型能力可能带来新的严重危害风险,如生物和化学威胁、网络安全以及人工智能自我提升——承诺在模型开发过程中评估模型,确保其在部署前达到安全标准。

帕乔基表示,这些规则需要随着技术的发展而演进。

格拉斯说,这些“中等规模、痛苦的决定,我们正在做出许多”,正在导致研究放缓。我们认为这是正确的做法。”Pachocki表示,对一致性和安全的信心已成为OpenAI进步的限制,就像计算能力的获取一样。

公司仍计划出航Astra,但其释放现需确认新安全措施的通过,领导层不会估计其发射日期的影响。在一个以数周为单位衡量技术领先优势的行业中,即使是短暂的中断也可能影响收入预期,并在更广泛的经济中引发连锁反应。

OpenAI至少目前愿意承担这些成本。Pachocki希望AI能力的快速增长能促使企业协调。Glaese表示,随着能力提升,OpenAI将持续提高安全标准。

“如果我们到了不安全的地步,那我们就得放慢速度,”她告诉我,“这就是现实。”

目前尚不清楚这会如何影响OpenAI上市的时间表。熟悉两家公司计划的人士预计OpenAI的首次公开募股时间会晚于Anthropic,尽管两者都尚未公开确定具体日期。

在8月19日的员工全体会议上,首席财务官弗赖尔告诉员工,如果业务“持续变化”,公司将在2027年或更早公开上市。OpenAI最新报告的年化收入约为400亿美元,落后于Anthropic的650亿美元。

近期研究放缓可能会使情况复杂化。Friar已经开始与上市公司进行演练,包括与OpenAI顶级投资者的模拟财报电话会议。她告诉我,公司“今天完全有可能上市”,但采取这一步将带来新的压力,因为OpenAI试图在商业顾虑与AI能力提升可能带来的潜在危害之间取得平衡。

员工们几乎会先从股票价格开始检查。“这是他们做的第一件事,”她说。“我今天赚了多少钱?我损失了多少?这太分心了。”

OpenAI今年的研究目标之一是自动化初级AI研究人员的工作。Pachocki表示,公司已经达到了自动化AI研究实习生的内部标准。他说,只要有实验想法,Astra可以在OpenAI的代码库中实现,运行实验并返回结果,或者拿一篇论文完成人类研究人员之前需要一周的工作。

这个里程碑很重要,因为它可能引发一个复利循环:人工智能帮助运行实验,产生更强大的人工智能,进而帮助更快地构建继任者。研究人员称之为递归自我提升,或者RSI。

在帕乔基的叙述中,递归的自我提升与对齐是交织的问题。帕乔基解释道:“人们是如何被带领踏上这段旅程的?人们究竟从中受益,而不是被越来越聪明的人工智能抛在后面?”

在产品方面,奥特曼设想了一种通用人工智能订阅,打破ChatGPT、Codex和工作软件之间的界限。用户会陈述目标,系统将决定部署哪些模型、工具和代理。

最终,它被设计成在被请求之前行动,自行推荐事物,并完成一些琐碎的任务,比如自主购买演唱会门票,基于它对你日历的访问、对财务的了解以及对你音乐品味的理解。

这一切都是 ChatGPT 从一个解答问题的工具,发展成一个能完成任务的工具的愿景。负责负责ChatGPT和Codex联合组织的产品负责人Thibault Sottiaux表示,OpenAI即将展示出一款围绕“持久性和始终在线执行”打造的产品。

他说系统几乎可以从任何地方访问,并且会根据新信息和反馈持续开展有益的工作。“这对人们来说肯定会是新鲜事,”索蒂奥告诉我。

OpenAI的路线图从此变得更加宏大。2025年5月,OpenAI收购了由前苹果设计师Jony Ive共同创立的硬件初创公司io,将其产品和工程团队纳入OpenAI。

Ive和他的公司LoveFrom保持独立,但承担了公司内广泛的创意职责。奥特曼表示,OpenAI正在开发“少数”设备,包括“适合放在桌上的东西”、可以放入口袋的物品以及佩戴在身体上的物品。

熟悉计划的人士表示,首款预计明年初推出,是一款小型、圆盘状的设备,设计用于感知周围环境,并通过ChatGPT的语音模式与用户对话。

“最大的调整将是适应主动计算机的理念,”奥特曼说,意思是它为所有者行动,而不是等待被使用。

奥特曼相信,总有一天,每个人都应该拥有一个专属机器人。他告诉我,OpenAI“肯定”会制造类人机器人。它投资了由奥特曼共同创办的初创公司Merge Labs,该公司正在开发一种非侵入式脑机接口。

OpenAI设计的第一个推理芯片Jalapeño,旨在运行AI模型,而非训练它们。OpenAI计划在年底前开始部署该芯片。

与此同时,它正在权衡是否要以少有企业尝试过的规模成为基础设施公司。7月,公司宣布在佐治亚州建立数据中心园区,8月签署了俄亥俄州更大场地的租约。

“我认为我们将能够非常有利可图地利用我们计划构建的所有计算资源,”奥特曼说。“我确实对整个世界所做的事情感到有些恐惧。”

如果OpenAI在为自己构建AI基础设施方面变得足够快速且低廉,领导者表示,公司最终可能会考虑向他人出售计算能力,这将使其直接与亚马逊网络服务(Amazon Web Services)和谷歌云(Google Cloud)等超大规模企业竞争。

对于一家最近承诺放弃分散注意力的支线任务的公司来说,这是一整套新项目的选择。当被问及总结时,布罗克曼用两个词形容了这个愿景:“个人通用人工智能(AGI)。他想象着数十亿人拥有超级智能的个人助理,等待指示。“你口袋里几乎有了一个AGI,也许很快真的是AGI,”他说。“你想要什么?”——报道者莱斯利·迪克斯坦,夏洛特·胡,以及西蒙·沙阿

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论