刚刚,GPT-6代号再泄露,或将周四见

marsbit發佈於 2026-08-18更新於 2026-08-18

文章摘要

据传,OpenAI下一代模型GPT-6(内部代号Astra)可能于本周四(8月20日)发布。近期多次出现泄露迹象:代号“mewfour”在代码仓库中被发现,涉及最高推理档位“xhigh”的独立自动审查,并曝光了其作为完整AI工作台测试ChatGPT核心UI的界面。 此前,OpenAI一篇论文显示,Astra内部版本以约2000美元的成本,解决了10个困扰数学界十年以上的难题,包括首个非sofic群的显式构造。8月7日,OpenAI官方评估认为Astra可能已达到网络安全最高风险等级“Critical”,意味着它可能具备独立发现零日漏洞或执行复杂网络攻击的能力。 报道称,Astra约有10万亿参数,采用混合专家架构,是从预训练阶段就原生支持多智能体协作的模型。这将使其能高效协调多个智能体(如GPT-5.6家族的Sol、Terra、Luna)进行长时程复杂任务协作,实现当前架构难以达到的效能。

据传,下一代GPT-6本周就要来了!

这不刚在昨天,OpenAI「义父」Tibo亲自爆料,Codex将接入最强Astra模型。

消息一出,全网瞬间沸腾,人们期待值直接拉满。

就连Polymarket上,关于OpenAI本周发布下一代Astra的概率,飙涨到了52%。

谁能想到,就在今天,Astra内部检查点代号「mewfour」再次泄露。

GPT-6,周四见?

AI大V Chetaslua意外发现,8月7日,就在OpenAI发布Astra达达到「严重风险等级」博文两个半小时后,直接把「mewfour」代号从52个PR中清除。

但痕迹没删干净。

6天之后,这一神秘代号再次出现在openai/codex的仓库commit记录中。

这些PR里审查方式标注为「独立自动审查」,推理级别直接拉到xhigh,这是目前已知的最高思考档位。

更关键的是,截图直接曝光了mewfour工作的真实环境——

界面里会话管理、连接器、技能、插件、自动化流程一应俱全,几乎是一个完整的AI工作台。

而mewfour在上面审查的,也全是ChatGPT即将上线的核心UI组件。包括编辑器「+」菜单、连接器与工具权限开关、侧边栏分组排序等等。

OpenAI团队估计也按捺不住了,在全网疯狂玩梗。

一位Codex研究员SIGKITTEN,连发四个Codex,外加两个Tibo。

开发者Haider现场解谜,一波演算下来,直接得出8月20日(周四)上线Astra。

果然,还是OpenAI的手法。

紧接着,「义父」发了一首「小诗」,还是一三二四句押韵。

虽还没有人破解「义父」所言,但这渲染的氛围,让人不得不来一句:

「在黎明前,把Astra带给大家」。

全网都在等发布,但Astra到底有多强?答案早在8月初就摆上了桌面。

2000美元破解十年难题

8月1日,OpenAI扔出一篇长达249页的数学论文,引发全网轰动。

论文的核心内容是,Astra的内部版本解决了10个至少十年未取得进展的数学和理论计算机科学难题。

这些问题横跨高维几何、编码理论、群论、量子复杂性、格密码学、极值组合学。

其中就包括首个非sofic群的显式构造,它被称为群论里的圣杯级问题,数学家们追了几十年都没拿下。

最让人坐不住的数字不是论文页数,而是成本。

按照GPT-5.6 Sol当前的API费率(输入$5/百万tokens,输出$30/百万tokens),生成全部十个解答的token成本,大约2000美元。

一台中端笔记本电脑的钱,换来十个困扰数学界十年以上的突破性证明。

这也意味着,数学界过去十年的产出效率,正在被一个API调用重新定义。

而这还只是内部版本,Astra正式上线后的能力上限在哪,OpenAI自己可能也没完全摸清。

如果你觉得这已经够疯狂了,8月7日的消息会让你彻底坐不住。

强到自己都害怕

8月7日,OpenAI官方发了一条让整个安全社区屏住呼吸的声明:

初步评估显示,Astra可能达到了Preparedness Framework下的网络安全「Critical」能力阈值。

什么是Critical?

根据OpenAI的Preparedness Framework,模型的网络安全能力被划分为多个等级,而Critical正是其中的最高一档。

在这个级别下,模型可以独立识别并开发多种严重程度的零日漏洞,或针对加固目标制定并执行端到端的攻击策略。

直白点说,这个模型可能具备了独立发起高级网络攻击的能力。

Sam Altman直接发帖回应:Astra非常强大,我们会做好安全准备,然后让所有人都能用上。

多智能体原生时代要来了

Astra的另一面,杀伤力可能不亚于网络安全。

The Information此前报道,Astra被训练为能让多个智能体长时间协同解决复杂问题。

传闻约有10万亿参数,采用混合专家架构(MoE),每个token只激活部分参数,基于内部代号「Doug」的预训练项目构建。

据泄露信息,它在推理、编码、写作、知识、多模态理解和智能体任务上全面超越Claude Fable,写作质量也有明显提升。

如果消息属实,这将是大模型历史上首次,从预训练阶段就把多智能体协作能力端到端训练进去。

看看OpenAI在GPT-5.6家族上已经搭好的多智能体基础设施,就知道这意味着什么。

Sol(旗舰)、Terra(性价比)、Luna(最快最便宜),三个模型组成了一套分层协作的多智能体体系。

今年上线的v2系统让Sol和Terra在并行执行时互相通信,上周Codex又把Luna加进来作为子智能体。

技术分析师Dan McAteer点出了关键一步——

如果Astra真的是在原生多智能体框架里预训练出来的,那它天生就具备长时程协作能力,开箱就能在Codex里协调多个智能体,把轻活派给更便宜的Luna。

这是当前架构怎么打补丁都做不到的,就像当年Claude Code在智能体式编码上的破局,直接换掉了一整套底层逻辑。

如今,OpenAI的员工已经在公开喊Astra的名字了。

现在的问题只剩一个,是这周,还是下周。

参考资料:

https://x.com/chetaslua/status/2089292588243411023

本文来自微信公众号“新智元”,作者:ASI启示录

相關問答

Q根据文章,关于GPT-6的发布有哪些具体线索或推测时间点?

A文章提到,开发者Haider通过演算得出Astra(被推测为GPT-6)可能于8月20日(周四)上线。同时,网络上的各种泄露信息和OpenAI团队成员的玩梗行为都加剧了“本周四发布”的猜测。

QAstra模型在数学和科学问题上取得了什么突破?

A根据文章,Astra的内部版本解决了10个至少十年未取得进展的数学和理论计算机科学难题,涉及高维几何、编码理论、群论等领域。其中最引人注目的是完成了首个非sofic群的显式构造,这个成果的成本大约仅为2000美元。

QOpenAI的Preparedness Framework中,网络安全‘Critical’级别意味着什么?

A根据OpenAI的Preparedness Framework,网络安全能力等级中的‘Critical’是最高档。处于此级别的模型可以独立识别并开发多种严重程度的零日漏洞,或者针对加固目标制定并执行端到端的攻击策略,意味着其可能具备独立发起高级网络攻击的潜在能力。

Q文章中提到Astra在模型架构和能力上有什么特别之处?

A文章指出,Astra传闻约有10万亿参数,采用混合专家架构。其最大的特别之处在于,它被训练为能让多个智能体长时间协同解决复杂问题,可能是在预训练阶段就把多智能体协作能力端到端训练进去的,这被认为是原生多智能体能力的重大突破。

Q文中所说的‘mewfour’是什么,它泄露了哪些信息?

A‘mewfour’是Astra(可能即GPT-6)的一个内部检查点代号。其泄露的信息显示,它在一个类似完整AI工作台的环境中,对ChatGPT即将上线的核心UI组件(如编辑器‘+’菜单、权限开关等)进行‘独立自动审查’,且推理级别达到了目前已知的最高思考档位‘xhigh’。

你可能也喜歡

交易

現貨
活动图片