Anthropic全球警告,OpenAI已跨“可靠性阈值”:AI自我加速启动

marsbit发布于2026-06-06更新于2026-06-06

文章摘要

AI领域出现重要警告与发展洞察。Anthropic发出全球警告,指出AI递归自我改进进程加速,已接近“自己造自己”的临界点,呼吁减缓研究。 与此同时,OpenAI后训练团队负责人Yann Dubois在访谈中揭示了关键内部视角: 1. **能力提升是连续线性,但实用性感知是跳跃的**。AI能力在达到“可靠性阈值”前如同玩具,跨越后则成为可托付工作的可靠工具。OpenAI被认为在去年12月左右跨过了此阈值。 2. **AI正进入自我加速循环**。模型能力提升后,本身已成为研发的有力工具(如辅助编程),从而加速下一代模型的开发,形成越转越快的正反馈回路。 3. **AI构建更像“手艺”而非纯科学**。在硬核领域,经验、直觉和反复试错(类似“炼金术”)目前扮演关键角色,科学解释常事后补足。 4. **垂直应用(Harness)价值巨大,甚至能触及AGI体验**。Dubois认为,若冻结现有模型,仅通过精心打磨针对特定领域的编排系统,即可在许多场景中实现类似通用人工智能(AGI)的效果。当前瓶颈常在于“最后一公里”——权限、数据连接与业务流程集成,而非模型智能本身。 5. **持续学习仍是核心挑战**。模型难以像人类一样在特定环境中持续学习和优化,其学习曲线容易趋于平缓,这是亟待解决的重要问题。 综上,AI发展已迈过关键可靠性门槛,进入自我加速阶段,同时为垂直领域的深度应用与集成创造了巨大机遇与挑战。

AI圈平地一声雷!

Anthropic向全人类发出警告:停止研究AI!

Anthropic内部数据显示,AI正在加速AI的发展,通往递归自我改进的路径或已浮现。

换句话说,AI正在接近「自己造自己」的临界点。

这一进程比Anthropic预想的更快,所以Anthropic呼吁减缓或暂停AI研究。

而与此同时,OpenAI 后训练团队负责人 Yann Dubois 在最新访谈中,给出了一个更微观但同样令人深思的视角:

AI进化不是突然开挂,而是刚过合格线!

在最新访谈中,他揭秘了多项内部视角:

AI能力的增长是线性的、连续的,但用户体验到的「有用性」却是离散的、跳跃的。

因为在达到某个「可靠性阈值」之前,AI只是一个会变戏法的玩具;一旦跨过那个点,它就成了能托付工作的员工,会自我加速。

这个阈值,OpenAI在去年12月左右才跨过了这道坎。

此外,Yann Dubois提出了反直觉的论断:AI构建更像「手艺(Craft)」而非「科学」。

这个洞察极具张力:在这个最强调硬核算力的领域,最终胜出的竟然是类似炼金术的「flare(直觉/灵感)」。

他还提出「最后一公里的AI红利」。

如果现在冻结所有模型,只靠做垂直应用(Harness),我们其实已经能实现AGI了。

瓶颈不在模型大脑,而在「权限、连接和数据」。这直接给正在观望的开发者泼了一盆冷水,同时也指明了金矿所在。

可靠性阈值已过,AI自我加速

过去几周,AI圈热闹不断:GPT5.5发布、Claude Mythos也出来了。

尤其是在网络安全、AI智能体写代码这块,给人的感觉真是日新月异,AI的进展让人感觉像突然「跳了一大格」。

Dubois的说法很不客气:能力提升其实一直挺连续,大家之所以觉得像坐了火箭,是因为中间隔着一道「可靠性门槛」。

门槛没跨过去之前,AI像个聪明但爱闯祸的实习生:能写、能算、能出主意,但你不敢把活彻底交给它。

门槛跨过去之后,你才敢让它「真上岗」。

他判断OpenAI大概是在「去年12月」跨过了这条线,于是才出现了外界感受到的「阶梯式跃迁」。

更刺激的是第二层原因:当模型足够好,它会反过来加速研发本身。

这就是Anthropic最担心的事。

Dubois提到,尤其在编程场景里,研究人员自己天天写代码,模型一变强,等于全员多了个不睡觉的搭档——既能帮研究者把工具链搭起来,也能在训练下一代模型时「以AI养AI」。

加速回路一旦转起来,就会越转越快,最近几个月「越来越猛」并不奇怪。

这也发生在Anthropic内部,到2026年第二季度,人均每个季度贡献的代码,已经是2024年第一季度的8倍。

第三个推动力,来自强化学习(RL)的「转型升级」。

早期像o1这类推理模型,主要在「可验证奖励」的任务上猛刷分——数学题、编程竞赛,因为对错清清楚楚,奖励好定义。

但过去一年,他们把在竞赛里练出来的那套工具,往更真实、更模糊的工作场景迁移:不再只优化「有标准答案的题」,而是优化「用户觉得真有用的东西」。

一句话:从刷题选手,开始往职场打工人进化。

AI工程师不是科学家,AI是「养」出来的

可一旦走进真实世界,麻烦就来了:可靠性怎么提?

Dubois给了个非常直白的「概率模型」:

既然现在很多都是AI智能体(agentic)系统,你可以粗暴地想成「每两分钟就有一定概率犯错」;运行时间越长,最终答案翻车的概率就越高。

所以所谓「提升可靠性」,本质就是不断把这个「每两分钟出错率」压下去。

这是AI智能体固有的硬骨头。

这也解释了为什么Dubois说,AI的构建更像「手艺活」,不像课本里的「科学实验」。

现实流程往往是:先靠经验、直觉、反复试错把东西做出来,甚至带点「炼金术」味道;等它真能跑、真能用,再回头补更科学的解释与方法论。

他还提到一个颇具反转的小插曲——

当年ChatGPT公开说用了RL,他第一反应是「太复杂了吧,用监督微调(SFT)就够了」,这也正是他在Stanford做Alpaca时想验证的思路。

但后来事实显示,一旦模型规模跨过某个水平,RL真的会「突然开始好用」,只是代价不低——采样很多答案、判断哪些对、哪些错,算力和系统工程都很烧钱。

垂直领域Harness已达AGI

说到「把AI拉进现实」,绕不开最近创业圈最爱挂在嘴边的词:Harness(编排系统)。

有人把它当成AI智能体的「外挂骨架」,也有人怀疑它迟早被模型「吃掉」。

Dubois的态度很现实:

短期内,垂直场景的Harness很值,能把可靠性从80%推到85%。

但前提是你得接受:模型在持续变强,Harness也得反复重调。

想做一个长期稳定、放之四海而皆准的「通用Harness」,他认为基本走不通。

甚至他还抛出一句很「挑衅」的判断:如果今天把现有模型「冻住」,只认真打磨Harness并围绕它训练,很多领域的人可能会「明显感到通用人工智能(AGI)的味道」。

最后一公里

但真正让Dubois既兴奋又皱眉的,是「持续学习(continual learning)」这道老大难。

三年前ChatGPT刚火时,他和朋友甚至认真讨论过要不要创业做个性化记忆与持续学习。

当时他们觉得「6个月内OpenAI就会搞定」,于是没做;三年后他人都进OpenAI了,却发现这事仍没真正解决。

现在模型的尴尬在于:第一天空降到公司,可能比多数新员工还顶用(起点高);但之后基本「保持原样」,因为它不会在特定环境里越干越懂你、越干越高效。

人类学习曲线是往上爬的,AI这条线却容易变平。

把AI的曲线从「平的」掰成「持续上升」的,Dubois认为会是接下来最重要的问题之一。

所以,创业公司还有没有空间做垂直应用?

Dubois给的答案很干脆:不但有,而且很大。

因为真正的瓶颈往往不是「模型够不够聪明」,而是最后一公里——权限怎么给、数据怎么接、连接器怎么打通、怎么嵌进具体业务流程。

大模型在天上飞得再高,不落地也只能当烟花;而把它拽到地面、让它拿到该拿的钥匙、打开该开的门,反而是最有含金量的苦活累活。

参考资料:

https://x.com/Potatoloogs/status/2062494654885749126

https://www.youtube.com/watch?v=DhD1zZ8w8Mw&t=3s

本文来自微信公众号“新智元”,作者:ASI启示录

热门币种推荐

相关问答

Q根据文章,OpenAI在什么时候跨过了所谓的'可靠性阈值'?

AOpenAI大约在去年12月跨过了可靠性阈值。

Q文章中提到,AI能力的增长与用户体验到的'有用性'有何不同?

AAI能力的增长是线性、连续的,但用户体验到的'有用性'是离散、跳跃的。

QYann Dubois认为AI构建更像什么,而不是科学?

A他认为AI构建更像'手艺(Craft)',而非科学。

Q文章认为,当前实现AGI的瓶颈主要是什么?

A瓶颈主要在于'权限、连接和数据',即应用落地的最后一公里问题,而非模型大脑本身。

Q根据Dubois的观点,Anthropic内部数据显示AI发展加速的一个具体表现是什么?

A到2026年第二季度,Anthropic内部人均每个季度贡献的代码量已经是2024年第一季度的8倍。

你可能也喜欢

图解Cloudflare钱包:使用X402的稳定币支付新玩家

8月4日,Cloudflare宣布推出Wallets,但当前仅开放用户认领“handle”(名称),而充值、付款等核心功能尚未上线。此次发布更接近于确立付款方身份,而非完整的支付解决方案。 Cloudflare近期支付相关产品包括:处于开放测试的Stripe Projects(代理为用户刷卡开通服务)、仍在等候名单的Monetization Gateway(商户收款入口),以及此次的Wallet。三者侧重不同,Wallet旨在补充付款方的身份、余额与授权规则。 x402协议数据显示其网络过去30天处理超7500万笔交易,总金额约2424万美元,平均每笔0.32美元,符合API调用等微支付特征。但这反映的是开放协议的整体活动,并不能直接等同于Cloudflare钱包的采用率或代理自主消费规模。 Cloudflare文档示例将单次API调用定价为0.01美元,并展示了基于HTTP 402状态的微支付流程。但目前开发者路径仍需自行保管私钥并使用测试网络货币。Wallet计划区分账户持有者的主钱包与代理使用的虚拟钱包,并引入额度、白名单等风控规则,但这些功能尚未开放配置。 当前存在三条不同的代理支付路径:Stripe Projects使用支付令牌且设有消费上限;x402开发者路径需自持私钥;而Wallet仅开放名称注册。三者仅在“代理支付”概念上共享交集,Cloudflare钱包的稳定币支持、链选择、地区合规及费率等关键细节仍有待公布。

marsbit29分钟前

图解Cloudflare钱包:使用X402的稳定币支付新玩家

marsbit29分钟前

TradeXYZ与Hyperliquid:揭秘50%分成下的共生关系

市场情绪趋向谨慎,AI投资需兼顾增长与现金流才会受认可;加密市场则面临ETF资金流出和利率上升的压力。加密货币内部,市场热点轮动至Solana和去中心化交易所(DEX)板块。 宏观层面,美股主要指数表现分化,黄金微涨,而比特币表现较弱。AI巨头财报显示,市场更青睐能证明投资回报且不严重损耗现金流的公司。加密市场持续承压,ETF资金转为净流出,国债收益率高企压制风险偏好。 在加密领域,Solana生态本周表现最佳,主要受个别代币上线主流交易所推动;DEX板块紧随其后,Uniswap因费用机制扩展至新链而上涨。文章指出,围绕Uniswap v4 hooks的链上创新值得关注。 文章重点探讨了交易平台TradeXYZ与底层链Hyperliquid之间的关系。TradeXYZ在Hyperliquid上构建,并将其协议收入的一半分给Hyperliquid。针对外界关于TradeXYZ可能因分成过高而离开、或Hyperliquid如何实现价值的担忧,文章分析认为,双方是高度共生的关系:Hyperliquid提供了关键的基础设施和用户基础,而TradeXYZ的执行力是RWA市场增长的关键。离开对双方都是“声誉自杀”,且不切实际。Hyperliquid除分成外,还通过其他费用和二阶效应(如增加稳定币供应带来收入)获利。 核心问题在于双方如何从追求增长的“低费率”模式,转向更稳定、更高的费用基础以实现长期盈利。

marsbit44分钟前

TradeXYZ与Hyperliquid:揭秘50%分成下的共生关系

marsbit44分钟前

报道:DeepSeek 重启融资,投前估值 5000 亿元

多名交易人士透露,DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元,目标8月下旬完成签约。此前,该公司于今年4月启动、6月完成首轮融资,募资500亿元,估值超3500亿元,创下中国AI大模型领域首轮融资规模纪录。 第二轮融资在7月中旬开启后一度暂停,据称与创始人梁文锋对网上流传的“投资者会议实录”不满有关。目前重启后,公司与投资方希望低调推进。部分投资机构表示尚未收到重启通知。 本轮融资名单包括首轮落选机构及既有投资方的增资意向。DeepSeek首轮投资方包括国家人工智能产业投资基金、腾讯、宁德时代、溥泉资本、网易、京东等。首轮融资意向资金超1000亿元,显示市场热度高涨。 若本轮顺利完成,DeepSeek两轮融资总额将超1000亿元,估值较首轮提升约43%。其融资规模远超同行,例如月之暗面近期以约2100亿元估值完成融资,并已启动Pre-IPO轮。 模型能力与效率直接影响公司估值。DeepSeek原定7月中旬发布的V4正式版略有延迟,V4-Flash已于7月31日公测,其Agent能力显著提升,在多项基准测试中表现优异。第三方评测显示,其智能水平国内领先,且延续高性价比路线,API调用成本低于多数竞争对手。 在推理成本上升的背景下,高性价比成为行业趋势。近期OpenAI亦下调模型价格,但DeepSeek-V4-Flash发布后性价比优势再度凸显。据OpenRouter榜单,该模型本周Token消耗量已居全球首位。

marsbit1小时前

报道:DeepSeek 重启融资,投前估值 5000 亿元

marsbit1小时前

交易

现货

热门文章

从H2A到A2A:AI Agent经济体与Crypto新机遇

6月17日,哈佛大学独立研究员、美国AI科学院(NAAI)通讯院士、比特币基金会终身会员韩锋做客火币HTX《大咖讲堂》第三期,以《从H2A到A2A》为主题,分享了其对Agent经济、Crypto基础设施及数字社会未来发展的思考。

565人学过发布于 2026.07.01更新于 2026.07.01

从H2A到A2A:AI Agent经济体与Crypto新机遇

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

2026年,美股IPO市场重回高热度。本文梳理即将上线或受关注的热门赛道龙头,分析具备投资潜力的交易标的及其逻辑,并探讨宏观趋势与相关风险。

2.6k人学过发布于 2026.07.08更新于 2026.07.08

美股TradFi:传统金融在AI IPO浪潮下的稳健锚点

相关讨论

欢迎来到HTX社区。在这里,您可以了解最新的平台发展动态并获得专业的市场意见。以下是用户对AI(AI)币价的意见。

活动图片