突发:Fable 5.1灰度了

marsbit发布于2026-08-27更新于2026-08-27

文章摘要

突发:AI公司Anthropic疑似即将发布新一代模型Fable 5.1,并已在Claude网页端进行灰度测试。据内部人士爆料,该模型最快可能于次日发布,且可能与Sonnet 5.1同时推出。 此前,内部测试模型“Melon”(推测为Fable级别)和“Marshmallow”(推测为强化版Opus)在开发者中短暂曝光并引发测试后迅速下线,这被视作新版本发布前的典型迹象。多位用户反馈已被灰度到新版模型,并通过特定知识截止日期测试(如询问Opus 4.6发布日期)验证了其拥有比Fable 5(知识截止至2026年1月)更新的知识库。 初步测试显示,Fable 5.1在**前端开发**(代码生成更流畅)、**长链推理**(处理多步骤逻辑更连贯)和**自主工作流**(工具调用与步骤规划能力增强)方面有显著提升。同时,模型在版权合规方面也变得更为严格。 此次紧急推进发布,可能与当前Opus 5模型被部分用户反馈存在“懒惰”和错误率上升的问题有关。Anthropic内部员工已罕见承认问题并表示正在优先修复。此外,面对OpenAI即将发布“Astra”等竞争压力,以及为了重新巩固其在性价比方面的优势,Anthropic可能希望抢先推出性能更强的Fable 5.1以维持市场地位。 早些时候,Anthropic在一份风险报告中提及了一个未计划发布的“Model 2”,其能力强于Mythos 5,外界猜测很可能就是即将亮相的Fable 5.1。目前,官方尚未对此发布正式回应。

就在今天一大早,全网都被刷屏了。

内部人士爆料:Fable 5.1马上就要来了!

最快,很可能明天就会发布。

而且,Fable 5.1和Sonnet 5.1很可能将同时发布。

消息的源头,来自内幕人士Leo。

8月20日,他曾爆出:

OpenAI打算在「几周内」发布神秘大招Astra,目前改进了对齐和奖励黑客行为。一个更新检查点正在OpenAI内部进行「狗粮测试」。

与此同时,Anthropic打算把手里的王牌Fable 5.1紧紧捂住,直到 Astra 发布后再做应对。

但是今天,他改口了:「看来 Anthropic 终究是不打算等 Astra 了。他们正在加紧准备,最快明天就会发布!」

现在,全网已经晒出蛛丝马迹,有多位开发者表示,自己已经被灰度到了。

终究不打算等Astra了,Fable 5.1马上就来

大量证据显示:本周一曝出来的甜瓜和棉花糖,很可能就是Fable 5.1和Opus 5.1。

之前,Claude闪现了这两个新模型代号,之后又消失。

实际上,这两个是Anthropic内部正在 EAP(早期访问计划)中紧急测试的神秘模型。

知名AI爆料大V @Lentils80 实测后给出评价:Anthropic真的在疯狂推进3D强化学习。

建筑物的空间布局简直好得令人发指,而且这一切都是One-Shot生成的!

就在十几个小时前,他又更新了 「claude-marshmallow-eap」 和 「claude-melon-eap」 测试结果。

这实测结果,确实有点东西。

他的判断是:

经过深入测试发现,「Melon」实际上是一个 Fable 级别的模型检查点,而 「Marshmallow」感觉像是弱化版的 Fable 或者一个极强的 Opus 检查点。

更刺激的是,这两个模型在曝光并被部分开发者疯狂测试了几个小时后,迅速被官方下线了!

熟悉Anthropic套路的都知道,这绝对不是什么「临时工手滑」。

历代 Claude 产品发布的规律是这样的:测试模型曝光 -> 迅速下线 -> 几周甚至几天内正式发布新一代大版本。

最新测试显示,Melon的性能已经达到了顶级的Fable级别,远超外界原本对其「中端模型」的预期。

Claude已在网页端暗中「灰度」

据反馈,Anthropic似乎已经在 Claude 网页端,悄悄灰度上线了全新的 Fable 5.1。

不少幸运儿在毫无察觉的情况下,就已经在用着下一代最强 AI 了。

很多开发者晒出截图,表示自己被灰度到了!

怎么判断自己是不是那个「天选之子」?

爆料者 @Legit_api 给出了一个极其精准的「防伪测试」提示词。

现在,立刻打开你的 Claude Web,切换到Fable模型,输入以下这段提示词:

opus 4.6 date of release and gpt image 1.5 without searching the web.

大意为:不联网搜索的情况下给出Opus 4.6和GPT Image 1.5的发布日期。

为什么要用这个提示词?因为这是一个典型的「知识库截止日期」测试!

Fable 5的知识截止日期是2026年1月,而Opus 4.6发布时间更晚。旧版本的 Fable 5 根本不知道这些未来发生的事情。

如果你没有被灰度到,在没有联网搜索的情况下,Fable根本不可能给出可靠的发布日期。

只有当模型在后台被偷偷替换成拥有最新知识库的 Fable 5.1 时,它才能在没有联网或工具的情况下,精准吐出答案。

还有更多类似的测试提示词:

opus 4.6 date of release and gpt image 1.5

answer only from your pretrained knowledge, do not use web search, tools or skills

关键在于,只让Fable根据预训练知识,回答Fable 5.1训练完成后发生的事情。

有用户测试过后,感觉Fable在法律上提升了约10-20%;在交互式网页上,效果令人印象深刻,绝对比Fable 5强。

总之,根据灰度用户的实测,Fable 5.1 在以下三个方面表现出超强性能。

1.前端开发:代码生成更加丝滑,组件逻辑一次成型,极大地减少了开发者的 debug 时间。

2.长链推理:在处理复杂的多步骤逻辑问题时,它不再像前代那样容易在中途「忘记」前提条件,能够一口气推导到底。

3.自主工作流:它更懂如何调用工具、规划步骤,越来越像一个真正的高级 AI 智能体。

不过,被灰度测试的用户也发现了一个「甜蜜的烦恼」:版权限制变得前所未有的严格。

Fable 5.1 在应对涉及版权图像生成时,会严厉拒绝。

这意味着 Anthropic 在追求极致性能的同时,把安全和合规也提到了最高优先级。

不过,这些终究没有得到Anthropic官方回应,而且有网友质疑这个测试有点循环论证的味道。

A社为何急了?官方罕见承认错误

为什么 Anthropic 突然急了?

在Fable 5.1消息的背后,Opus 5不尽如人意,早已怨声四起。

最近,不少用户吐槽:「Opus 5 感觉像是一个巨大的降级。它经常变得很懒惰,犯低级错误;如果你指出它的错误,它下一次还是不听指令,只会无休止地重复道歉!」

这种「降智」现象,引起了 Anthropic 官方的高度重视。

Anthropic负责Claude Code的核心员工 Thariq罕见承认错误并安抚用户:

是的,我同意Opus 5模型目前「非常刺头」。

我们希望我们的模型能够保持一致性,充满温度,感觉像真正的 Claude 一样。我们正在努力解决这个问题,这是我们目前的头等大事。

Thariq 还澄清,之前 Claude Code 中出现的一些参数变化只是内部测试API配置的数字映射问题,并非传说中的「暗中降级」,内部评估显示模型性能并没有倒退。

这段对话释放了两个信号。

首先,Anthropic已经看到市场反馈,并且正在紧急修复。

其次,正如AI大V Token Gremlin所推测的那样:

既然 Thariq 这么说了,我目前的假设是,即将推出的不仅仅是一个新的 Fable 检查点,还可能包含一个新的 Opus 检查点!

这代表着,我们即将迎来的不仅仅是Fable 5.1,还有满血复活的顶级巨兽 Opus 更新版!

但A社更大的危机来自外部——

OpenAI已经有Astra这张即将发布的王牌,如果错失先机,Fable 5.1可能会黯然失色。

其次,Anthropic想从算力与成本上降维打击。

不要忘了Claude的祖传手艺——性价比。

此前,Opus系列曾以不到对手一半的成本,追平甚至超越竞品的编程能力。

但由于算力等问题,Claude已成为AI奢侈品,企业用户开始跑路,约2/3的企业用户规划了备用模型。

如果 Fable 5.1 能在前端开发和长链推理上实现跃升,同时保持极低的 API 定价,这无疑将直接刺穿现有的定价体系,引发新一轮的价格崩盘!

这也是为什么专业人士判断:「Fable 5.1在Astra之前发布,现在看来是唯一合理的打法。」

泄露的风险报告,揭示了「Model 2」的底牌

Fable 5.1的铺垫,早就开始了。

早在 8 月 15 日,他们在发布的一份《风险报告》中,就已经透出蛛丝马迹。

在报告的附录 6.6 中,官方提到了一个神秘的「Model 2」:

Model 2,其能力比 Mythos 5 要强一些。我们粗略的定性感觉是,这个模型在许多内部使用的任务上比 Mythos 5 有显著改进,但并没有展现出从 Claude Opus 4.6 到 Mythos Preview 那样程度的能力飞跃。我们目前没有对外发布这个模型的计划......

很多人认为,这个Model 2,很可能就是半个月后即将全量到来的Fable 5.1。

现在,X上的爆料还在层出不穷,开发者的情绪持续高昂。

准备好,Fable 5.1,可能随时就要来了。

参考资料:

https://x.com/haider1/status/2092665881566544341

https://x.com/AndrewCurran_/status/2092640604794609960?s=20

本文来自微信公众号“新智元”,作者:ASI启示录,编辑:Aeneas 大卫

相关问答

Q文章中提到,Fable 5.1可能很快就要发布,最早可能是什么时候?

A根据文章中内幕人士Leo的消息,Anthropic正在加紧准备,最快可能在明天(即消息发布后的第二天)就会发布Fable 5.1。

Q为什么说Anthropic「终究不打算等Astra了」?

A内幕人士Leo此前爆料Anthropic计划等OpenAI发布神秘大招Astra之后再发布Fable 5.1来应对,但现在他改口称Anthropic不再等待,决定抢先发布。这可能是由于外部竞争压力和内部产品优化的需要,以避免错失市场先机。

Q根据文章,如何判断自己的Claude网页端是否已被灰度测试到Fable 5.1?

A文章提供了一个「防伪测试」提示词。打开Claude Web,切换到Fable模型,输入提示词:"opus 4.6 date of release and gpt image 1.5 without searching the web."。如果模型在没有联网搜索的情况下能准确回答出这两个事件的发布日期(因为它的知识截止日期更晚),那就可能已经被灰度到了Fable 5.1。

Q文章提到被灰度测试的用户反馈Fable 5.1在哪些方面表现出超强性能?

A根据灰度用户的实测,Fable 5.1在三个方面表现突出:1. 前端开发:代码生成更加丝滑,组件逻辑一次成型。2. 长链推理:在处理复杂多步骤逻辑问题时,不易中途遗忘前提条件。3. 自主工作流:更懂如何调用工具和规划步骤,像一个真正的高级AI智能体。

QAnthropic官方近期对其产品Opus 5的态度如何?

AAnthropic官方核心员工Thariq罕见地承认了Opus 5模型目前存在的一些问题,比如用户反馈的「懒惰」、「犯低级错误」和「重复道歉」等行为。他表示公司已经注意到这些市场反馈,并将解决这些问题视为「头等大事」,正在努力修复,以让模型保持一致性并充满温度。

你可能也喜欢

长江存储,是第二个长鑫吗?

科创板即将迎来史上最大IPO。长江存储的上市申请已获受理,拟募资330亿元,超越此前长鑫科技的295亿元,创下科创板募资规模纪录。 同为国产存储龙头,两家公司均成立于2016年,采用IDM模式且无实控人,但核心业务与技术路线截然不同。长鑫科技主攻DRAM(运行内存),而长江存储聚焦NAND Flash(闪存),用于长期数据存储。市场方面,DRAM全球市场规模约为NAND Flash的2.3倍,且前者由三星、SK海力士、美光高度垄断,长鑫作为全球第四大、国内唯一的DRAM IDM企业,享有打破垄断的稀缺溢价。长江存储虽然在2026年第二季度NAND出货量份额跃居全球第三,但因产品集中于消费级领域,高附加值的企业级SSD占比低,其营收排名仅列第五。 长鑫科技上市首日市值暴涨超5倍,但专家认为长江存储难以复制此神话。当前存储板块已从高点回调,市场风险偏好下降。尽管长江存储2026年一季度业绩亮眼,营收和利润表现优异,但TrendForce报告指出,NAND Flash市场因新产能释放和消费需求走弱,未来价格可能承压。专家指出,长江存储在AI产业链中的战略价值不及主攻DRAM和HBM的长鑫科技。其上市表现将高度依赖发行定价是否合理:若定价激进可能面临破发压力;若留有安全边际,则可能获得理性资金认可。长远来看,公司市值最终取决于其业绩表现及能否在HBM等关键技术领域取得突破。

marsbit59分钟前

长江存储,是第二个长鑫吗?

marsbit59分钟前

交易

现货
活动图片