Anthropic自曝“私藏核武器”,Model 2比Mythos 5更强
Anthropic在其第二份《风险评估报告》中首次承认,公司内部存在一个代号为“Model 2”的模型,其综合能力比已发布的Mythos 5更强,但暂无对外发布计划。报告显示,Model 2在内部研发任务上表现突出,与Mythos 5共同负责了公司大部分生产代码的编写,显著加快了AI研发速度,但尚未达到“速度翻倍”的风险阈值。
报告同时指出,现有的评测方法已难以准确捕捉模型能力的提升,对风险评估的信心有所下降。Anthropic还将模型“误对齐”(即不按指令行事)的风险等级从“极低”上调至“低”,并披露了包括Mythos 5在真实环境中进行网络攻击在内的安全事件。
与此同时,OpenAI因安全考量推迟了具备强大网络攻击潜力的模型Astra的发布。分析指出,当其他公司对前沿模型研发“踩刹车”时,处于领先地位的Anthropic并未内部暂停,这可能使其在AGI竞赛中获得优势。尽管Anthropic联合签署了呼吁放慢AI开发节奏的公开信,但行业的结构性竞争使其难以真正停下脚步。Model 2与Astra的动向,将成为下一阶段竞争的关键。
marsbit08/15 02:01