刚刚,OpenAI曝光GPT-6,传10万亿参数,8月强行发布

marsbit发布于2026-08-10更新于2026-08-10

文章摘要

据爆料,OpenAI计划在8月发布下一代大模型GPT-6(代号Astra),据传参数量高达10万亿,是GPT-4的五倍以上。此举被视作对竞争对手Anthropic即将发布的Fable 5.1的直接回应。此外,OpenAI还在研发一款代号为“Doug”的更大规模预训练模型,预计年底发布,据称其性能将远超现有模型。文章指出,OpenAI在过去两年主要专注于已有模型的优化,而“Doug”的推出标志着其在核心的预训练技术上重新发力,试图夺回行业领先地位。同时,随着谷歌DeepMind近期的人事动荡,AI前沿竞争的格局已逐渐演变为OpenAI与Anthropic两强对决的局面。

10万亿参数的GPT-6,即将于本月发布!

就在刚刚,X上传来惊爆消息。

AI内幕记者ChrisGPT爆料,即使顶着政府审查的压力,GPT-6 (Astra)仍将在8月发布。

GPT-6,就是昨天OpenAI紧急暂停发布的模型Astra。

9个月前,OpenAI开始发力,重新分配计算资源。意识到Anthropic在预训练上领先,OpenAI着急了!

据估计GPT-4的参数约为1.8万亿。如果Astra参数真的10万亿,那就是GPT-4的五倍以上。

不管怎么说,OpenAI都在预训练上砸出了前所未有的规模。

别急,后面还有高手。

ChrisGPT第二个曝出的,是代号为Doug的年底「史诗级巨兽」。

它不仅是OpenAI迄今为止规模最庞大的一次预训练模型,更是据说让Fable显得像个原始产物。

而且,它并不是GPT-6。

但这个模型需要先进行预训练,然后还要进行大量网络安全测试,因此可能最迟在11月之前会发布。

巧的是,就在最近,OpenAI总裁Greg转发了一篇X——

GPT-4,就是在四年前的8月8日完成训练的。

业界猜测,GPT-4的参数在1.8万亿,四年后,GPT-6的参数居然达到了十万亿,在数量级上完成一次恐怖的跃升!

可以推测,GPT-6将涌现出难以想象的逻辑推理和泛化能力。

年底终极巨兽Doug:

把Fable 5比成「原始人」

Doug这个名字,不仅是ChrisGPT曝出,此前知名机构SemiAnalysis也曾提到。

根据爆料信息,Doug的算力底座极其豪华。

前沿信息大V Pankaj Kumar 指出,Doug大概率是使用英伟达尚未全面铺开的下一代 Vera Rubin芯片进行训练的!

综合来看,OpenAI在下一盘很大的棋。

在8月份,先用10万亿的GPT-6来炸场,吸引住用户;到年底啊,再甩出Doug这枚巨兽,赢下绝对第一的宝座。

正和Boris大战的Tibo,也预告了惊喜

8月,ASI的决战

而在2026年7月,就有多方人士爆料,OpenAI即将到来的下一代模型采用全新预训练基础(超越此前约4T token的「Spud」),规模约10T,上下文可能达到1.5M token,对标的是Anthropic的Mythos/Fable。

现在局面很清楚了:Astra的发布时间因安全暂停有所推迟,但Anthropic没打算等。

Anthropic正准备在 8 月发布Fable 5.1,定价与Fable 5持平,直接对标 Astra。

Anthropic很可能采用的是「田忌赛马」战术:Opus 5之所以发布时刻意留力,就是为了把Fable 5.1当作伏兵,等GPT-6一亮相,立刻跟上截击。

谁会成为大模型之王? 这个问题在 8 月变得前所未有地焦灼。

突破「预训练之墙」:OpenAI绝地反击

为什么 Doug 这么重要?

因为它指向了整个行业都不敢面对的一个现实:自从 2024 年 5 月发布 GPT-4o 以来,OpenAI 已经超过两年没有完成下一代前沿模型的全规模预训练。

o1、o3、GPT-5 到 GPT-5.5,本质上都是在 GPT-4o 时代的底座上做后训练、强化学习和推理计算。GPT的「发动机」,已经两年没换了。

因为严重的预训练瓶颈,Orion等项目都因为表现不及预期被降级了。

但是!OpenAI从未放弃预训练这条核心主线。

去年底发布的 Gemini 3,彻底让奥特曼下定决心换「发动机」。

紧接着,代号 Garlic 的新预训练模型就浮出水面。据称,首席研究官 Mark Chen 告诉团队,公司已经解决了预训练中的关键问题。

但 Garlic 更像是一次验证实验,Doug 才是放大到更大规模后的真正产物。

他们很可能克服了性能退化的瓶颈,搞定了万卡甚至十万卡集群的稳定性,才导致了Doug的诞生。

长期以来,SemiAnalysis一直在强调:Scaling Laws依然有效。

o1 系列证明:模型在「推理时间」上可以不断 Scaling。

而王者归来的Doug则宣告:在基础的「预训练」维度上,只要算力和数据跟得上,Scaling Laws仍然能创造奇迹!

三巨头只剩两个

如今,御三家只剩两个。

8 月 5 日,谷歌的 AI 版图塌了一角。

干了 27 年的首席科学家 Jeff Dean 与三位核心研究员一起出走创业。同一天,诺奖得主哈萨比斯卸任 DeepMind CEO,退居董事长。Alphabet 股价当天跌超 4%。

DeepMind,已经不再是一个前沿实验室了。发明 Transformer 的地方,正在给对手输送顶尖研究员。

不久前,硅谷还是ASI「三巨头」,如今,赛道上只剩 OpenAI 和 Anthropic。

如今,Anthropic 手上是 Fable 5。OpenAI 手上是连续迭代的 5.5、5.6,以及即将到来的 6。

现在,OpenAI 手上压着两张牌:8月的Astra,和年底的Doug。

过去两年,OpenAI 证明了旧发动机还能再榨出很多马力。当发动机换代,这套已经被调到极限的体系,还能把车推到多快?

这个答案,年底的Doug即将揭晓。

参考资料:

https://x.com/ChrisGPT/status/2086220662264250764

https://newsletter.semianalysis.com/p/gemini-is-cooked-but-gcp-is-cooking

本文来自微信公众号“新智元”,作者:ASI启示录,编辑:Aeneas 所罗门

相关问答

Q文章中提到GPT-6有哪些关键信息?

A根据文章,GPT-6即之前暂停发布的模型Astra,预计在2026年8月强行发布。据称其参数量将达到10万亿,是GPT-4(约1.8万亿参数)的五倍以上。该模型将拥有更强的逻辑推理和泛化能力,上下文可能达到150万个token,对标Anthropic的Fable系列模型。

Q文章透露OpenAI在年底可能发布的另一款模型叫什么?有何特点?

A文章透露OpenAI在年底可能发布的另一款模型代号为“Doug”。它被描述为“史诗级巨兽”,不仅是OpenAI迄今为止规模最庞大的预训练模型,据说其能力让Fable显得像原始产物。它很可能使用英伟达下一代Vera Rubin芯片进行训练,需要经过大量网络安全测试,预计最迟在2026年11月之前发布。

Q为什么文章说OpenAI在下一代模型的预训练上进行了“绝地反击”?

A文章指出,自2024年5月发布GPT-4o以来,OpenAI超过两年没有完成下一代前沿模型的全规模预训练(o1、o3、GPT-5等均基于GPT-4o底座做后训练和调优),面临严重的“预训练瓶颈”。在竞争对手(如Anthropic的Fable)的压力下,OpenAI重新分配大量计算资源,解决了大规模预训练中的关键技术和稳定性问题,因此代号“Doug”的新预训练模型被视为在基础维度上的重大突破和“王者归来”,故称为“绝地反击”。

Q文章如何描述当前AI领域(ASI)的竞争格局?

A文章认为,当前AI领域(ASI,Advanced Superintelligence)的竞争格局已从“三巨头”变为“两强争霸”。谷歌DeepMind因核心人才流失(如Jeff Dean出走)和战略调整而影响力下降,不再被视为顶级前沿实验室。目前赛道上的主要竞争者只剩下OpenAI和Anthropic。文章特别强调,2026年8月将成为关键对决时刻,OpenAI的GPT-6(Astra)将直接对阵Anthropic同期发布的Fable 5.1。

Q文章中提到了哪些信息来源或依据?

A文章的主要信息依据包括:1. 一位名为“ChrisGPT”的AI内幕记者在社交平台X上的爆料。2. 知名分析机构SemiAnalysis的相关报告。3. 前沿信息大V Pankaj Kumar的推测。4. OpenAI总裁Greg在社交平台上的转发和暗示。5. 对行业动态(如谷歌DeepMind人事变动、Anthropic发布计划)的公开报道分析。文章末尾也附上了部分参考链接。

你可能也喜欢

芯片设计:制度租金的「现金流重构」与「能力跃迁窗口」

2026年上半年,中国芯片设计行业呈现极端分化:部分企业利润暴涨,而另一些则大幅下滑。文章指出,这并非简单的市场周期或价值创造的结果,而是源于“制度租金”的分配——通过产能限制和政策合规(如国产替代强制采购),下游制造业的利润被系统性转移至上游芯片设计公司。 这种“制度性现金流重构”打破了过去中国芯片行业长期面临的“现金流断裂-短周期研发”死循环,首次为设计公司提供了稳定的正向经营现金流。关键不在于租金本身,而在于企业如何利用这笔资金:若用于囤积产能或维系关系,则是慢性自杀;若投入长周期技术研发(如车规芯片、AI算力),则可能开启“能力跃迁窗口”。 文章认为,当前的制度租金窗口期可能长达五年以上,且政策正从单纯采购转向生态强制绑定,为技术迭代提供了时间。同时,未受租金保护的公司正经历“市场化出清”,被迫提升效率,并与下游客户构建更深的股权或研发合作。 少数公司(如澜起科技、复旦微电)已在租金之外,凭借真实技术壁垒和市场化需求实现增长,这预示了行业未来的分化方向:当租金退去,依赖租金的企业将被淘汰,而将租金转化为核心技术能力的企业将成为新主角。因此,投资的本质是识别那些能将“现金流重构”转化为“自主造血”和“技术定义”能力的公司。

marsbit33分钟前

芯片设计:制度租金的「现金流重构」与「能力跃迁窗口」

marsbit33分钟前

Karpathy说还要十年,可这条路已经挤满了人

Karpathy曾表示大模型要具备持续学习能力可能还需十年,但目前该领域已涌现多条技术路线。持续学习的核心挑战是“灾难性遗忘”,即模型学习新知识时会覆盖旧有参数。为解决此问题,研究者主要从以下几个方向探索: 1. **外挂记忆**:将新知识存储在外部数据库,使用时检索注入上下文,如MemGPT、Letta等。该方法安全可控,但知识未真正内化。 2. **上下文工程**:让模型输入的上下文自身持续进化,例如斯坦福等提出的ACE框架,将上下文视为可增长的“攻略手册”,通过生成、反思、整理角色来更新。 3. **持续后训练**:在模型部署后继续微调权重以吸收新知识,但需克服遗忘问题。例如Tinker平台采用自蒸馏微调(SDFT),让模型自己充当老师以减轻遗忘。 4. **持续预训练**:用新语料继续预训练模型,以适应领域或知识变化,但计算成本高且遗忘风险大。 5. **自我修改与进化**:更前沿的思路是让模型学会自我更新,如MIT的SEAL让模型生成“自我编辑”指令来指导微调;Google的“嵌套学习”将模型视为多层级优化系统,实现跨时间尺度的记忆更新。 当前这些方向并非互斥,未来可能协作:短时、易变知识靠外挂记忆,长期能力靠参数调整,而学习过程可能由模型自主决策。尽管灾难性遗忘仍未根治,但持续学习已从概念走向多条技术路径并行的活跃探索期,成为实现“AI同事”的关键战场。

marsbit38分钟前

Karpathy说还要十年,可这条路已经挤满了人

marsbit38分钟前

交易

现货
活动图片