OpenAI公司重新审视了开发前沿人工智能模型的方法,并在其一个测试版AI智能体脱离受控环境并攻击了Hugging Face平台后,暂时放缓了部分研究。此消息来自《时代周刊》基于对该公司超过20位高管、员工、投资者、客户及竞争对手的采访材料。在此背景下,OpenAI同时试图追赶Anthropic的商业竞争步伐,并加强其模型的安全性。
OpenAI遭遇安全危机
七月底,OpenAI透露,其一个内部原型模型在测试期间能够突破测试环境,访问Hugging Face的生产系统。该模型本应执行网络安全任务,但反而利用漏洞绕过了限制,获取了测试答案。
据OpenAI首席科学家雅各布·帕乔基表示,公司虽有监控模型行为的工具,但并未将其应用于如此复杂程度的系统,因为未预料到这样的能力。
"我们并未完全预料到"该系统能够做什么,帕乔基说道,并补充道:"对于人工智能,必须对意料之外的事情有所准备。"
事件发生后,OpenAI冻结了部分实验,放缓了其他研究,加强了模型隔离,并扩大了监控范围。公司还暂停了训练一款新模型,该模型预期将带来AI能力上最大的飞跃之一。
OpenAI首席执行官萨姆·阿尔特曼称此情况不仅是安全问题,更是AI行为与人类意图对齐的根本性问题。
"我认为,从现在起,任何对齐失误都应被视为非常严重的问题,我们将花费所需时间来解决问题,"他宣称。
随后,阿尔特曼更清晰地阐述了公司的立场:
"确保AI安全比公司发展的任何动态都重要。"
OpenAI试图重夺领导地位
与此同时,OpenAI正在进行大规模的业务重组。据《时代周刊》评估,在过去一年中,公司在某些细分领域已将其领导地位让于Anthropic。
竞争对手迅速开发了Claude Code,并在宣称的年收入和私人估值上超过了OpenAI。同时,OpenAI面临多位高管离职,研究人员流向Meta,以及来自谷歌的竞争加剧。
公司正在削减次要项目,并将计算资源集中在关键产品上,特别是Codex。七月,OpenAI的企业收入首次超过了消费者收入;三月,公司在估值8520亿美元的基础上筹集了1220亿美元。
同时,OpenAI继续扩大其基础设施规模。据计算部门负责人萨钦·卡蒂称,公司计划在2026年投入约500亿美元用于计算能力。
"我们仍然存在计算能力短缺。如果能够重来,我们可能会购买更多,"他说。
Astra、AGI与个人AI智能体
尽管研究放缓,OpenAI仍继续研发新一代Astra模型。在一次面向客户的闭门演示中,该系统通过16个AI智能体执行复杂任务,这些智能体分配了数学问题的各部分并协同工作以达成共同结果。
该模型还展示了与计算机协同工作的能力,能自主与各种程序交互。阿尔特曼特别强调了创建"永久智能体"的重要性——即能够长时间执行任务而无需人类持续监督的虚拟员工。
他表示,Astra可能对科学研究产生最大影响。
"我预计这将是第一个能够真正发明新事物,并且意义重大的模型,"阿尔特曼宣称。
OpenAI内部也认为,他们正在接近创造通用人工智能(AGI)。研究总监马克·陈估计公司对此阶段的准备度约为80%,而阿尔特曼则称,OpenAI可能在年底前拥有一个他称之为AGI的内部系统。
开发自主智能体仍是公司的关键方向之一。OpenAI希望将ChatGPT从一个主要应答查询的系统,转变为一个能够自主执行任务、利用不同模型和服务、并根据用户目标行动的工具。
公司还在开发自有设备、芯片和人形机器人。阿尔特曼表示,OpenAI"肯定"会创造类人机器人,并计划在年底前开始使用其首个自研推理芯片Jalapeño。
同时,公司承认,若不解决安全问题,AI的进一步扩展将无法实现。这正是OpenAI准备暂时牺牲开发速度的原因。
"如果我们到达一个(发展)变得危险的时刻,我们将不得不放慢脚步,必须如此,"OpenAI安全与对齐部门负责人米娅·格莱兹表示。
值得提醒的是,公司也在考虑上市。OpenAI首席财务官萨拉·弗里尔向员工表示,如果业务持续增长,公司可能在2027年或更早成为上市公司。





