突发!OpenAI下一代AI攻克10项菲尔兹奖级难题

marsbit发布于2026-08-02更新于2026-08-02

文章摘要

OpenAI发布其下一代AI模型Astra,在数学领域取得轰动性突破,一举攻克了10个长期未解的难题,其中多项成果被专家评价为“菲尔茨奖级别”。这些突破涵盖了高维几何、群论、算子代数等多个核心数学分支,相关论文长达249页。 最引人注目的成果包括:构造出首个无限有限呈现的“非sofic群”,否定了自1999年提出相关猜想;在高维球体堆积问题上,打破了自1978年以来人类未能突破的理论极限;推翻了菲尔兹奖得主Alain Connes提出的“刚性猜想”,构造出无限多不同构但生成相同冯·诺依曼代数的群。 据称,生成这10项证明的总计算成本仅约2000美元。所有证明均通过了Lean 4形式化验证,确保了其严密性。这一系列成果被视作AI在深度推理和数学直觉上的重大飞跃,标志着AI已成为数学研究领域的强大工具。

OpenAI还有大招!

奥特曼刚演示的内部模型Astra,一口气在10个数学难题取得重大突破!

这249页的PDF,在整个数学圈都是非常炸裂的程度。

论文:https://cdn.openai.com/pdf/ten-proofs-oai.pdf

证明:https://openai.com/index/ten-advances-in-mathematics/

Github开源Lean证明:https://github.com/openai/ten-proofs

数学家、美国数学学会Fellow、罗格斯大学杰出教授Alex Kontorovich难掩震惊,只留两个惊叹号。

这是一个足以载入史册的分水岭时刻:无论在数学领域,还是AGI的征程上。

说得直白些:如果这些结果经受住整个学界的检验,那么单是今天的这一轮发布,便堪称现代史上相关领域单日跨度最大的一次飞跃!

Claude Fable 5更是直言:「按照菲尔茨奖标准,任何一项都足以获奖」!

最令人震惊的是,破解这十大难题,OpenAI竟然只用了2000美元。

数学界地震!载入AI史册的一刻

五月份,OpenAI公布了AI发现的埃尔德什单位距离猜想的反例。

但现在确认了,这是OpenAI的下一代模型Astra破解的,也是奥特曼现在正在给美国国会演示的那个模型。

现在,OpenAI又分享了Astra在至少十年没有进展的难题上的最新成果。

这些问题涉及高维几何、编码理论、算术电路复杂度、群论、算子代数、量子复杂度、格密码学和极值组合学等广泛领域。

消息一出,数学圈瞬间炸锅!

其中,最出色的成果,可能是Astra终结了Gromov自1999年提出的非sofic群问题。

钱学森母校加州理工学院的某位数学博士称:「这是菲尔茨奖级别的成果」!

按照Epoch AI的OpenMath的评分标准,GPT-5.6 Sol Pro和Fable 5 Max认为:

大部分结果都能得到同行的高度认可,被评为「Major Advance」(重大进步)。

唯独第三项,具有破圈的潜质,有望成为全年数学领域最佳成果之一,被评为「突破」。

第三项结果也是一个反例:

OpenAI Astra构造出无限有限呈现的非sofic群,否定「所有可数群都是sofic」的猜想。

曼彻斯特大学皇家学会大学研究员、数学家Thomas Bloom直言:这次突破比此前OpenAI证伪单位距离猜想更重要。

而且,生成这10项突破性成果证明的总成本,如果按Sol API价格计算还不到2000美元,平均200美元。

也就是说,解决一个有科研价值的猜想大约只相当于一名研究生一个周末的津贴。

而这一切,竟只是评估一个未发布模型时意外收获的「副产品」。

另一点,大家不注意看,可能就忽略了:

这10个猜想是OpenAI精选之后的结果!

OpenAI推理模型的核心缔造者Noam Brown直接放出重话。

他直言,OpenAI确实尝试过其他难题,目前还没有成功解决一个类似黎曼猜想这样的千禧年大奖难题。

但更关键的是,测试时计算远未封顶,连百万美元级别的世界性难题也可能被啃下。

让人既感慨又伤感:数学还会是人类心智的荣耀吗?

249页PDF,太震撼了

这份249页的论文之所以震动数学界,不在于计算推演,而在于AI如数学大师般,在几何、代数、群论等领域同时完成降维打击式的证明与证伪。

一次在多个不同的领域,取得多项硬核突破,或许无人能及。这本身就让人印象深刻。这次我们主要介绍3大问题。

斩断世纪执念:找出史上首个「非Sofic群」

1999年,俄罗斯数学家、「数学诺贝尔奖」挪威阿贝尔奖得主Mikhail Gromov提出了sofic群的概念。

Sofic,来自希伯来语「有限」。

通俗地说,如果一个无限大的复杂群,能够用有限的置换去完美逼近、模拟它的局部乘法表,那它就是Sofic的。

你可以把它想象成「无论多么复杂的无限三维模型,都能用有限的像素点(体素)完美渲染出来」

问题随之而来:所有可数群,都是sofic群吗?

这不是一个冷僻的技术细节。Sofic群的性质牵动着sofic熵理论、动力系统遍历论、算子代数等一整片数学版图。如果这个问题的答案是「否」,那就意味着存在某种根本上无法被有限结构逼近的群——整个理论框架都要重新审视。

27年间,无数顶尖数学家尝试构造反例,无一成功。

Astra给出的答案是:构造出一个无限有限呈现的非sofic群。

OpenAI Astra直接从数学的代码库里拎出了一个现成的结构:「二元Leavitt代数的单位群」,然后甩出一份无懈可击的证明:这个群绝对不可能被有限置换逼近!

为了证明这一点,AI的操作极其狂暴,它把Kun-Thom扩展图理论和著名的「汤普森群V(Thompson's group V)」糅合在一起,硬生生逼出了一个逻辑矛盾。

这就好比人类还在到处寻找无法被像素化的物质,AI直接指着桌上的一个高维魔方说:「别找了,就是它,我证明给你们看。」

完整构造。有论证。有细节。

更关键的是:用Lean 4做了形式化验证,并附上机器可独立检验的证书。

这是分水岭所在。Lean 4的证书意味着,每一个推理步骤都经过了机器的形式化核验,不存在靠「感觉对」蒙混过关的空间。

数学家Elliot Glazer第一时间确认消息属实,并称这是「迄今最重要的AI辅助数学成果」。

击碎46年冰封的结界:高维球体堆积问题

想象一下你有一个纸箱,怎么塞下最多的橘子?

在三维世界里,人类直到几百年前才通过开普勒猜想搞明白。而到了高维空间,这个问题变得如同梦魇。

2022年,数学家Maryna Serhiivna Viazovska因为解出了8维和24维的球体堆积(Sphere Packing)问题,拿下了数学界的最高荣誉「菲尔兹奖」。

震撼点:直接打破了自1978年以来人类在这个领域的「智力天花板」。

但注意,她解出的是「特定维度」。

如果维度走向无穷大,密度上限到底是多少?

自1978年两位苏联数学家给出一个极限后,整整46年,全世界最顶尖的数学家寸步难行,连小数点后几位都优化不了。

而这次,AI轻描淡写地走入了这个死胡同。

它不仅给出了全新的证明,还直接精确算出了Cohn-Elkies线性规划的指数衰减率,首次突破了1978年的边界!

这就好比人类在这座高山前爬了半个世纪爬不动了,AI直接开着直升机登顶,顺便把上山的路给铺平了。

超越菲尔兹奖得主直觉,推翻Connes刚性猜想

1982年的菲尔兹奖得主、非交换几何的奠基人Alain Connes提出了著名的「刚性猜想」:对于某类极其特殊的群,它们生成的冯·诺依曼代数(von Neumann algebra)就像指纹一样独一无二。

几十年来,数学家们一直在这个猜想的迷宫里打转。

结果,OpenAI的新模型不仅走出了迷宫,还把迷宫给拆了。

它不仅证明了康纳是错的,而且给出了一种极致碾压的证伪方式:它没有只找出一个反例,而是直接构造出了一个「可数无限的群家族」。

这些群彼此之间互不同构(长得完全不一样),但它们生成的冯·诺依曼代数却完完全全一模一样!

这就好比Connes曾断言「世上没有两片雪花拥有相同的内部原子结构」,而AI不仅找到了两片,它反手直接下了一场暴风雪,每一片雪花外观各异,但核心代数结构全等。

数学家的「破壁者」来了

「AI教父」辛顿预言:

在未来10到20年内,AI甚至可能创造出人类无法理解的新数学。

而OpenAI这次的结果让那个时间表看起来都太保守了。

除硬核数学证明外,OpenAI下一代模型Astra还知道如何利用「条件概率」去攻克量子纠缠游戏,知道如何利用「多项式求导」去建立计算复杂性下界。

解决这类问题需要真正的推理,OpenAI Astra掌握了极其深邃的纯数学直觉与构造能力。OpenAI这次还特意公开了完整推演过程:

https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf

这或许是一个明确的例子:AI比人类最好的数学家还聪明。

对于数学界来说,这篇论文无异于宣告着数学家的「破壁者」,已经来了。

参考资料:

https://cdn.openai.com/pdf/ten-proofs-oai.pdf

https://openai.com/index/ten-advances-in-mathematics/

https://x.com/stalkermustang/status/2083485500250198453

编辑:大卫

本文来自微信公众号“新智元”,作者:ASI启示录

热门币种推荐

相关问答

QOpenAI的下一代AI模型Astra在数学领域取得了哪些主要突破?

AOpenAI的下一代模型Astra在至少10个长期悬而未决的数学难题上取得了重大突破。这些成果主要涉及高维几何、编码理论、算术电路复杂度、群论、算子代数、量子复杂度、格密码学和极值组合学等领域。其中最引人注目的包括:构造出首个无限有限呈现的‘非sofic群’,攻克了Gromov自1999年提出的问题;在高维球体堆积问题上,首次突破了1978年以来的理论边界;以及推翻了菲尔兹奖得主Alain Connes提出的‘刚性猜想’,构造了互不同构但冯·诺依曼代数相同的无限群族。

Q生成这10项数学突破性成果的总成本是多少?其意义是什么?

A生成这10项突破性数学证明的总成本,如果按OpenAI的Sol API价格计算,不到2000美元,平均每个问题约200美元。文章指出,这一成本大约相当于一名研究生一个周末的津贴。其意义在于,它戏剧性地展示了高级AI进行前沿科学研究的成本效益。这预示着未来解决重大科学问题(甚至百万美元级别的世界难题)的门槛和资源消耗可能会被AI技术极大降低,从而加速基础科学的探索步伐。

Q文章中提到的‘非sofic群’的发现有何重要性?

A发现‘非sofic群’是一项菲尔兹奖级别的成果。它解答了自1999年由数学家Mikhail Gromov提出的一个核心问题:‘所有可数群都是sofic群吗?’ Astra不仅给出了否定的答案,还具体构造出了一个反例——二元Leavitt代数的单位群,并提供了严谨的证明。这一发现至关重要,因为它动摇了sofic熵理论、动力系统遍历论和算子代数等一整片数学理论的基础,意味着存在某种根本上无法被有限结构逼近的群,相关理论框架可能需要被重新审视。

QAstra在高维球体堆积问题上的突破具体指什么?

AAstra在高维球体堆积(Sphere Packing)问题上取得了46年来的首次突破。自1978年两位苏联数学家给出无穷维球体堆积密度的理论极限(上界)后,该领域一直停滞不前。Astra不仅给出了全新的证明,还精确计算出了用于求解该问题的Cohn-Elkies线性规划的指数衰减率,从而首次突破了1978年确立的理论边界,优化了密度上限。这标志着AI在解决高度复杂、长期困扰人类的纯数学问题上展现出超越人类当前最好成果的能力。

Q除了数学证明,文章还展示了Astra模型具备哪些其他能力?

A除了在纯数学领域的多项突破性证明,文章还指出OpenAI的Astra模型展示了深刻的推理和构造能力。例如,它知道如何利用‘条件概率’去攻克量子纠缠游戏,以及如何利用‘多项式求导’去建立计算复杂性的理论下界。OpenAI还公开了完整的推演过程文档,表明Astra并非仅靠计算,而是掌握了‘极其深邃的纯数学直觉与构造能力’。这些能力共同表明,Astra已经成为一个能够进行复杂科学推理和问题解决的通用人工智能系统。

你可能也喜欢

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit4小时前

如何让自己变得让人工智能永远也无法取代

marsbit4小时前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru7小时前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru7小时前

交易

现货

热门文章

如何购买MOVE

欢迎来到HTX.com!我们已经让购买Movement(MOVE)变得简单而便捷。跟随我们的逐步指南,放心开始您的加密货币之旅。第一步:创建您的HTX账户使用您的电子邮件、手机号码注册一个免费账户在HTX上。体验无忧的注册过程并解锁所有平台功能。立即注册第二步:前往买币页面,选择您的支付方式信用卡/借记卡购买:使用您的Visa或Mastercard即时购买Movement(MOVE)。余额购买:使用您HTX账户余额中的资金进行无缝交易。第三方购买:探索诸如Google Pay或Apple Pay等流行支付方法以增加便利性。C2C购买:在HTX平台上直接与其他用户交易。HTX场外交易台(OTC)购买:为大量交易者提供个性化服务和竞争性汇率。第三步:存储您的Movement(MOVE)购买完您的Movement(MOVE)后,将其存储在您的HTX账户钱包中。您也可以通过区块链转账将其发送到其他地方或者用于交易其他加密货币。第四步:交易Movement(MOVE)在HTX的现货市场轻松交易Movement(MOVE)。访问您的账户,选择您的交易对,执行您的交易,并实时监控。HTX为初学者和经验丰富的交易者提供了友好的用户体验。

1.2k人学过发布于 2024.12.10更新于 2026.06.02

如何购买MOVE

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对MOVE(MOVE)币价的意见。

活动图片