ChatGPT新模型Bel被曝预训练完成,参数高达10万亿

marsbit發佈於 2026-08-31更新於 2026-08-31

文章摘要

OpenAI被曝已完成代号为“Bel”的下一代AI模型的预训练,其参数规模高达10万亿,直指通用人工智能(AGI)门槛。该模型被视为“后GPT-6时代”的终极基座,在编码、推理和长程智能体任务上超越即将发布的Astra模型,并能以两种速度持续自我学习与改进。 与此同时,OpenAI据称在算力上已形成巨大优势,其自研芯片和内部递归自我改进(RSI)技术大幅降低了成本并提升了效率。公司高管透露,未来的AI将全面转向云端Agent集群,实现超低延迟交互,并最终融合为能主动理解用户需求的“个人AGI”。 尽管面临高层人事变动等挑战,但此次爆料显示OpenAI正通过“暴力美学”式的大规模投入,持续推动AI能力边界。2026年下半年,AI领域或将迎来新一轮巨变。

科技圈彻底无眠!

OpenAI最强模型Astra被曝下周四可能发布,目前已扩大测试范围。

此前,内部机密泄露,已正式接管自研芯片「Jalapeño」的底层代码。AI编写核心代码运行速度,比人类顶尖工程师快出1.8倍。OpenAI内部出现AI自我递归的迹象!

OpenAI还有一枚深水炸弹。

据传,OpenAI已成功跑通代号「Bel」的10万亿参数预训练模型,直指AGI终极门槛,甚至超过10万亿参数的预训练只是Bel的起点。在那之后,Bel可以以两种速度学习。

奥特曼已放话:我们应该为下一代模型发布再办一次派对。

GPT-6之后的世界,又藏着怎样的野心?

Bel:10万亿参数的深渊巨兽

今年,OpenAI似乎陷入了规模扩展的瓶颈,甚至紧急拉响警报「Red Code」。

为了集中算力,OpenAI甚至砍掉了Sora和AI浏览器Altas等产品。

下一代AI模型Astra一举拿下多项数学突破,惊艳世界,但迟迟不见发布。

最近几周,OpenAI人事动荡:首席收入官丹尼斯·德雷瑟、首席运营官布拉德·莱特卡普,以及曾任首席执行官萨姆·奥特曼副手的菲姬·西莫等高层相继离职。

正当外界纷纷猜测OpenAI是否已经「江郎才尽」时,多位硬核科技爆料人爆出,OpenAI刚刚完成了超大规模预训练,代号「Bel」。

这个「Bel」到底有多恐怖?

我们来看几个核心关键词:

1. 突破10T(10万亿)参数大关

万亿参数的GPT-4让AI拥有了接近人类本科生的常识与逻辑,那么10万亿参数的Bel,在复杂推理、长文本关联、跨学科多模态理解上,将呈现出怎样的「涌现能力」?

这是质变。

它相当于将当今世界上所有顶尖专家的脑容量打包在一起,再乘以一个指数级的放大器。在这个参数量级下,AI对世界模型的理解将达到一个前所未有的深度。

2. 「Doug」的继任者,GPT-6之后的终极基座

爆料指出,在此之前,OpenAI已经完成了代号为「Doug」的预训练。

Doug被定位为Astra计划以及传闻中的GPT-6的基础模型(后续还会经过极高强度的强化学习对齐)。

作为继任者,Bel则是比Doug更进一步的「后GPT-6时代」的下一代基座。

Bel直接瞄准了科技界的圣杯——AGI(通用人工智能)

据报道, Bel模型在编码、推理和长时程智能体任务方面均超越Astra。

消息人士称,该模型可在无人干预的情况下持续高效工作数天,能自我恢复,并协调数百个并行子智能体subagent。

3. Claude Fable杀手(The Fable Killer)

@ChrisGPT 在其推文中直言不讳:

Bel是OpenAI的「怪兽」级模型,旨在成为Fable杀手。

它应该会在今年年底前问世,或者在Astra发布后几个月内推出。

他甚至在六天前就已经拿到了这个代号,印证了消息源的可靠性。

在理论上,Bel可能已经超越GPT-6,甚至接近OpenAI定义的AGI阈值。

在GPT-5.6的官方发布中,他们引入了「RSI指数」,该指数整合了研究调试、内核与训练配方优化、机器学习实验以及模型自我改进等方面的成果。最终,sol模型在GPT-5.5的基础上提升了16.2分。

随后,sol又为其较小的草稿模型设计了数百项架构实验,启动训练。而且只有在硬件故障和训练不稳定的情况下人工才会干预。最终,token生成效率提升了超过 15%。

Bel成为一个真正意义上持续进化的存在。

快速权重层会在它工作期间吸收来自验证过的证明、代码测试、实验和工具轨迹中的经验教训。较慢的循环则会将那些在评估中存活的改进成果巩固到持久化权重和训练配方中。

它在快速记忆中迅速学习,把验证有效的改进固化为慢速权重,同时持续优化下一轮学习的运行机制,并将最终成果蒸馏成大家可以实际使用的小模型。

GPT-7或许只是Bel在某一周状态下的安全快照。

在Reddit的上,Leo的这则消息已经引发了大量讨论,毕竟Leo爆料向来可靠。

有人推测,内部模型可能领先外部模型4.5-6个月。

OpenAI放话:「Anthropic已经跟不上了」

如果说Bel是技术上的降维打击,那算力则是OpenAI内部士气高涨的绝招。

据多位追踪者的交叉分析,OpenAI判断,在接下来的2026年下半年到2027年,保持领先毫无悬念。

为什么这么笃定?因为算力

爆料提到,OpenAI内部评估认为,其最大的死敌Anthropic,算力短缺,难以应对OpenAI的下一代AI

在大模型的军备竞赛中,算力就是弹药。当模型参数飙升到10万亿级别时,训练一次耗资巨大。

Anthropic虽然在模型架构和对齐技术上造诣极高,但在绝对的「暴力美学」面前,显然已经力不从心。

面对即将到来的Astra公开亮相,Anthropic受限于算力瓶颈,今年内恐怕很难给出强有力的回应。

在其他公司还在为如何凑齐10万张H100/B200芯片而焦头烂额时,OpenAI已经用暴力美学砸出了「Doug」和「Bel」。

而随着OpenAI自研芯片Jalapeño的发布,护城河不仅没有被填平,反而被拉大了。

OpenAI Codex负责人揭秘「终局图景」

10万亿参数,或许让你觉得有些遥远。但在OpenAI内部,这些底层的暴力突破,最终都指向了同一个AI终局。

最近,在知名科技播客Matthew Berman的访谈中,OpenAI高管Tibo毫无保留地剧透了OpenAI在应用层的未来路线图。

他甚至豪言:

眼下极其强大的Codex模型,在未来2到3个月内,就会显得像个原始时代的产物。

结合前文的爆料,Tibo指向了四个颠覆性的巨变。

递归自我改进(RSI)每天都在OpenAI内部发生。

Tibo证实,「内部奇点」不仅存在,而且已经跑通了商业闭环。

OpenAI早就在用最强模型去优化自身的推理栈、CUDA内核甚至基础设施。

他举了个例子:OpenAI内部用Sol模型去优化Luna模型,直接将运营成本砍掉了80%!

「Ultra Fast(超高速)」将重塑人类心流。

Tibo透露,内部目前的Ultra Fast模式最高已实现14倍的加速。他预测,只需1到2年时间,这种超低延迟将成为行业默认标准。

当AI的响应速度逼近甚至超越人类的思考速度时,交互将变成实时的。工作流将彻底回到「心流状态(Flow State)」,人类的认知负担将呈指数级下降。

计算范式转移:你的电脑即将沦为「废铁」。

随着下一代模型(如Astra)的降临,Tibo明确指出:未来的AI主流绝对不再是本地运行,而是全面转向云端的大规模Agent集群

终极一击:ChatGPT与Codex融合,变身「Personal AGI」。

在未来,「机制将彻底消失」。你不再需要手动去写复杂的Prompt,不需要去维护技能文件(Skill file)或管理记忆体,更不需要手动去调度子Agent。

Personal AGI会持续、被动地理解你的目标、日常习惯和团队动态,并主动提供帮助。

更神奇的是它的动态UI适配。底层明明是同一套多模态、Voice-first的技术,但界面会根据你的身份像水一样自动变形。

结语:奇点已至,无形相伴

不管「Bel」的传闻有几分夸大,也不管Astra手撕人类专家代码是否真的如此丝滑,这次的大规模爆料,已经向全世界传递了一个不容忽视的信号:

人工智能的发展并没有停滞,它只是在积蓄一场足以掀翻牌桌的风暴。

2026年的下半年,好戏才刚刚开场。

参考资料:

https://x.com/ChrisGPT/status/2092334431142850782

https://x.com/fanofaliens/status/2091805645221789771

https://x.com/notjazii/status/2092336615473701361

https://www.reddit.com/r/singularity/comments/1vy99vk/according_to_leo_openai_just_finished_its_next/、https://x.com/imjustnewatai/status/2092482501524516888?s=20

本文来自微信公众号“新智元”(ID:AI_era),作者:大卫

相關問答

Q根据文章,OpenAI新曝光的Bel模型有哪些核心特点?

A根据文章,Bel模型的核心特点包括:1. 参数高达10万亿,被认为可能达到AGI(通用人工智能)的门槛。2. 是GPT-6之后时代的下一代基座模型。3. 在编码、推理和长时程智能体任务方面超越了Astra模型。4. 具备快速与慢速双重学习循环机制,能够持续自我改进。5. 能协调数百个并行子智能体并长时间无人干预工作。

Q文章中提到的“Claude Fable杀手”具体指什么?

A文章中将Bel模型称为“Claude Fable杀手”(The Fable Killer)。这指的是Bel作为OpenAI的“怪兽”级模型,其目标是超越或压制Anthropic公司开发的Claude模型(推测“Fable”是代指Anthropic的某个模型系列或项目)。爆料人ChrisGPT在推文中表示,Bel旨在成为这一强大竞争对手的“杀手”,并可能在Astra发布后几个月内推出。

QOpenAI高管Tibo在访谈中揭示了哪四个颠覆性的未来趋势?

A根据文章,OpenAI Codex负责人Tibo揭示了四个颠覆性趋势:1. **递归自我改进(RSI)**已成为日常,如用Sol模型优化内部系统,大幅降低成本。2. **“超高速”交互**将重塑人类心流,超低延迟响应将成为标准。3. **计算范式转移**,AI主流将从本地运行全面转向云端大规模Agent集群。4. **ChatGPT与Codex融合**,形成能主动理解用户、无需复杂调度的“Personal AGI”。

Q为什么文章认为Anthropic在竞争中“已经跟不上了”?

A文章认为Anthropic“已经跟不上了”,主要原因是**算力短缺**。在大模型的军备竞赛中,当模型参数量级达到10万亿(如Bel模型)时,训练成本极其高昂。虽然Anthropic在模型架构和对齐技术上造诣很高,但在绝对的“暴力美学”(即依靠海量算力堆叠模型规模)面前显得力不从心。面对OpenAI即将推出的Astra等下一代模型,受限于算力瓶颈的Anthropic短期内很难给出有力回应。

Q文章中提到OpenAI为集中算力推进Bel项目,采取了哪些行动?

A文章中提到,OpenAI为集中算力推进Bel等超大模型项目,采取了以下行动:1. **拉响内部警报“Red Code”**以应对规模扩展的瓶颈。2. **砍掉或暂停了部分产品**,如文生视频模型Sora和AI浏览器项目Altas,将资源集中到核心模型开发上。3. **内部人事出现动荡**,多位高层管理人员相继离职。这些行动都是为了将有限的算力资源集中用于突破性的超大规模模型(如Bel)的研发。

你可能也喜歡

a16z:顶尖人才涌向AI基建,基础设施设计将“推倒重来”

全球顶尖风投a16z宣布推出“机器时代基金”,专注投资AI基础设施领域。其核心观点是:AI算力需求正以千倍速扩张,而芯片、内存、电力、数据中心等供给严重滞后,缺口巨大且将持续数年,这已从工程问题演变为全面的资源瓶颈。 需求端,从聊天机器人到智能体,每个任务消耗的token数量呈指数级增长,预计年增速接近1000%。超大规模云厂商资本开支明年将突破1万亿美元,关键组件供应已排期至2028年,GPU甚至出现黄牛加价转卖。 供给端,传统计算堆栈已触及物理极限,无法满足AI工作负载。AI基础设施面临全面重构,包括: 1. 计算架构:需要为AI专门设计,从芯片、内存、互联到冷却方式均需革新。 2. 物理极限:机架功耗从10千瓦跃升至150千瓦,必须采用液冷,并面临高压直流电(仅2%美国电工有资质)和建筑承重等新挑战。 3. 电力短缺:到2028年,新数据中心电力需求与电网供给之间存在近20吉瓦的巨大缺口。 这一结构性变化正吸引大量顶尖创业者从软件转向硬件创业,相关初创公司首轮融资规模已达数亿美元量级。a16z认为,我们正处于一个将持续数十年的“机器时代”开端,硬件创新对提升效率和商业利润变得前所未有的重要。

marsbit1 小時前

a16z:顶尖人才涌向AI基建,基础设施设计将“推倒重来”

marsbit1 小時前

交易

現貨
活动图片