# 自我进化的所有文章

在 HTX 新闻中心浏览与「自我进化」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

大模型能写出工业级优化算法吗?MIT提出FrontierOR给AI设下考场

麻省理工学院等机构的研究者推出了FrontierOR基准,用于评估大语言模型(LLM)设计大规模优化算法的能力。该基准不同于传统测试建模或调用求解器的任务,重点考察LLM能否像运筹学(OR)专家一样,针对复杂工业问题结构,自主设计出可扩展、高效且高质量的算法,例如分解、启发式搜索或混合策略。 FrontierOR包含180个源自OR学术文献的真实任务,并筛选出50个更具挑战性的“Hard”子集。评测采用两阶段流程:首先生成的算法需通过小实例的可行性预筛,然后在工业级规模的大实例上评估其解质量、速度及综合质效(QTE)。 实验结果显示,顶尖模型如GPT-5.3、Claude Opus 4.6等,在代码可执行性上已接近上限,但要在Hard任务上生成同时满足高质量和高速度的算法仍很困难。分析表明,能力较强的模型已减少基础建模错误,失败模式转向搜索深度与策略设计不足。此外,研究测试了三种自演化框架(如CORAL),发现通过迭代优化,LLM生成的算法性能可显著提升,在部分最难任务上QTE指标能从0.15提升至0.50。 这项工作标志着LLM-for-OR的研究重心正从“能否建模”转向“能否设计算法”,为开发能自主设计优化算法的AI智能体指明了方向,未来可能在供应链、能源、交通等领域实现更智能的决策支持系统。

marsbit07/10 09:08

大模型能写出工业级优化算法吗?MIT提出FrontierOR给AI设下考场

marsbit07/10 09:08

担心AI自我进化,Anthropic打算停止训练?

2026年5月,Anthropic联合创始人杰克·克拉克预测,AI递归自我改进(RSI)在2028年底前发生的概率为60%,引发了AI安全研究者埃利泽·尤德科夫斯基的严重警告。随后,Anthropic发布题为《当AI自我构建》的长文,披露了内部数据:截至2026年5月,其超过80%的合并代码由Claude撰写;AI在代码优化任务上的速度提升显著,最长可独立工作时长每4个月翻一番。文章提出了三种未来场景,认为最可能的是AI持续替代人类研发环节,而完全自主的递归自我改进“有可能”发生。 然而,Anthropic的公开立场在同期发生了转变。2026年2月,公司修改了其“负责任扩展政策”,移除了“能力超出安全控制则暂停训练”的核心承诺,理由包括担忧单方面暂停会让激进的竞争对手领先。几乎同时,DeepMind CEO德米斯·哈萨比斯也调整了对外表述,称人类站在“奇点的山麓”,并将AGI时间线提前,他承认使用此类措辞是“有意挑衅”,旨在唤起各方紧迫感。 外部研究者对同一现象提出了不同解读。有人认为当前的AI自我改进存在损耗且难以持续,有人指出AI自动化的大部分是“苦力”而非“天才”工作,也有人赞同正处于关键拐点。与此同时,Anthropic的估值在2026年上半年从3500亿美元飙升至近万亿美元,其叙事节奏、政策调整与融资进展在时间上高度耦合。 分析指出,Anthropic与DeepMind等头部机构近乎同步地释放“加速”信号,构成了一次行业级的叙事转向。这些信号既是技术趋势的反映,也明显带有面向资本、监管和公众的传播策略考量。机构在技术不确定性、商业竞争与安全责任之间,正进行着精密的叙事平衡。

marsbit06/05 06:22

担心AI自我进化,Anthropic打算停止训练?

marsbit06/05 06:22

突发!Anthropic呼吁全员停止AI研究

人工智能公司Anthropic在其官方博客中发布重要观点,指出其AI模型Claude已展现出显著的“自进化”能力,即递归自我提升(RSI)的早期迹象。 核心数据显示,截至2026年5月,Anthropic代码库中超过80%的代码由Claude编写,而在其代码工具发布前,这一比例仅为个位数。工程师的代码交付量达到2024年的8倍。在编程质量上,Claude处理最复杂模糊任务的成功率在半年内从26%跃升至76%,其代码质量被认为年内有望超越人类。 Anthropic提出了“AI能独立完成的任务时长”这一新衡量维度:从2024年3月的4分钟,增至2025年的1.5小时,再到2026年的至少16小时,翻倍速度已加快至每4个月一次。若趋势持续,2027年可能达到数周。 在研究层面,Claude展现强大能力:将训练小模型的代码运行速度优化了52倍,远超人类水平;在一项AI安全研究中,其将效果差距缩小了97%,而人类研究员仅缩小23%。 Anthropic认为,人类在AI开发中的角色正不断收窄,最后优势可能仅剩研究品味与方向判断。公司描绘了三种未来:能力增长停滞;AI加速但人类主导;或AI实现完全递归自我提升,自主设计下一代AI,这可能带来巨大福祉,但也存在对齐失败、最终失控的风险。 为此,Anthropic呼吁,如果存在可验证的机制确保全球AI实验室能同步暂停竞争,其愿意减速甚至暂停研发。OpenAI近期也发表了类似观点,认为自进化迹象将加剧竞争与治理挑战。这表明AI发展的“奇点”可能正在加速逼近。

marsbit06/05 00:26

突发!Anthropic呼吁全员停止AI研究

marsbit06/05 00:26

活动图片