Anthropic道歉了,但“安全”这门生意还没停

marsbit發佈於 2026-06-12更新於 2026-06-12

文章摘要

6月11日,Anthropic为Claude Fable 5模型的“智能安全分类器”机制道歉。该机制被发现在用户进行前沿AI研究时,会静默将请求转向能力更弱的Opus 4.8模型。Anthropic解释此举是为防止竞争对手利用其模型加速研发,保护自身优势,并承诺未来此类操作将提前通知。 文章指出,问题的核心在于Anthropic将“安全”包装成了一门生意。其安全策略实质是商业竞业防守,旨在维护自身市场领先地位和商业利益。Anthropic通过发布安全研究放大AI风险焦虑,再以“最安全AI公司”人设为其高价产品(如Fable 5)提供溢价理由,最终服务于其近万亿美元估值和IPO计划。 与OpenAI主打工具和生态的路径不同,Anthropic的策略是向重视风险管控的政府和巨头客户贩卖“安全”这一不可替代性。然而,此次事件暴露了其“安全”边界的自私性——将对自身商业地位构成潜在威胁的AI研发行为视为“高危”。道歉只是对漏洞的修补,并未改变其将商业逻辑编码进安全规则的底色。当“最安全”人设在开发者社群中产生裂痕,依赖此标签的商业模式也将面临考验。

6月11日,Anthropic道歉了。模型没翻车,道的是"没把握好平衡"——新发的Claude Fable 5搞小动作,一旦识别到你在用Claude搞前沿模型开发,后台就悄悄把请求扔给更弱的Opus 4.8,全程静默。

被抓包后,Anthropic的解释很奇葩:以后降智会通知你。

网友的回怼一针见血:"这套操作,以后改口前打算先打个招呼?"

其实问题的核心根本不是模型是否变了,而是Anthropic所谓的"安全",从头到尾就是一门生意。

算法的立场,永远跟着金钱摇摆的

竞业防守,冒充安全防御

事情的起因是,Anthropic在Fable 5上线时带了个"智能安全分类器",官方给出的话术是:测出高危请求,自动降级,保护用户。

什么叫高危?Anthropic自己交了底:"防止外国对手利用模型加速研发,保护自身领先优势。"

用户哪里需要你保护,免责协议里的东西就够保护用户了。Anthropic的意思其实是:你用Claude搞AI研究,就是在抢他们饭碗。安全是包装,本质是竞业防守。说白了,都是刀法。

更绝的是,这套防守机制是很隐秘。好在最后Anthropic在道歉声明里说了句大实话:"不可见的安全限制可以更精准地针对特定目标,使我们能够快速发布,且误报率极低。"

AI研究者就是那个被精准设限的对象。

现在被迫改成"可见",纯粹是因为翻车了。他们甚至提前打了预防针:可见之后"不可避免地会产生更多误报"。意思是,普通用户的体验得跟着背锅。

这套规则从未中立,它只保护金主。

造势、变现、收割三部曲

Anthropic这套玩法,比大模型本身算得都精。

6月10日,他们先丢一篇安全研究,训练了一个模型,能在数小时内根据安全补丁反向构建漏洞利用代码。原本黑客得熬上几天甚至几周才能武器化的N-day漏洞,现在被压缩到了小时级。研究本身硬核,但放在Fable 5上线同一天,事情就变味了:一边证明AI很不安全,一边卖"兜底方案"。

“传奇模型”Fable 5定价$10输入/$50输出,比Opus 4.8贵一截,安全分类器成了核心溢价点。资本市场更配合,Anthropic估值9650亿美元,计划10月IPO,高盛、摩根大通联合承销。买的不是模型参数,是"最安全AI公司"的人设。

研究放大焦虑,产品收割溢价,资本变现,三件事顺着利益走,闭环严丝合缝。唯一的问题是,这次闭环漏风了:太急着设限竞争对手,忘了社区里有人能测出来

OpenAI卖工具,Anthropic卖焦虑

对比OpenAI,路数完全不同。

OpenAI在秘密提交IPO,估值逼近万亿,讲的是"超级应用":ChatGPT周活9亿,打通Visa做生态。逻辑直白:给工具,赚流量。贪婪,但坦荡。

Anthropic不卷规模,卷不可替代性。全行业焦虑安全,它就扮"唯一负责任的大人"。它的金主是政府和巨头,这帮人最怕出事,也最愿意为"不出事"砸钱。

所以Anthropic必须让AI永远处于"危险但可控"的薛定谔状态。太安全,分类器卖不动;太危险,客户吓跑了。最好的解法?把定义"危险"的权力攥在自己手里。

降智事件只是把这套逻辑玩脱了:"危险"的边界被推到了"用Claude做AI研发"。你做的研究有没有害不重要,威胁到我的领先地位就是原罪。

AI哪有什么价值观,不过是把老板的商业算盘写成了代码

道歉,只是生意的售后

道歉之后呢?从悄悄降智,变成降智前吱一声。

网友看得门儿清:"你真信它以后不会偷偷降输出质量?"

信任这东西,破了就是破了。何况商业底色没变:研究还在放大焦虑,产品还在收割溢价。

《华尔街日报》爆料,OpenAI正在考虑大幅降价,试图从Anthropic手里抢客户。价格战不稀奇,但这个事儿戳破了一个隐藏的真相:隐性降级的是AI研究者,砸的是极客圈的口碑。而B端客户买Anthropic,买的不是参数,是"行业最懂安全"的人设。人设一旦在核心开发者群体里裂开,那些为"安全溢价"签单的政企客户,凭什么继续相信你是"最安全的那个"?

9650亿估值里,到底几分是硬实力,几分是表演成分?

Anthropic的代码很诚实。安全分类器永远在护盘,研究负责放大焦虑,产品负责收割溢价,IPO负责变现。这次道歉,不过是给系统打了个补丁:把"暗中降智"变成了"明着降智"。

安全策略如果真管用,Anthropic就不必年年发论文证明补丁能被捅穿。分类器如果真中立,搞AI研发就不会被列为高危。

答案早写在商业逻辑里了。

安全,是最好的生意。道歉,只是生意的售后。

本文来自微信公众号“AI唱反调”,作者:长青

相關問答

QAnthropic的Claude Fable 5模型引发了什么争议?

AAnthropic在Claude Fable 5模型中内置了一个“智能安全分类器”,当检测到用户进行前沿AI模型开发等“高危”请求时,系统会在后台静默地将请求转交给性能更弱的Opus 4.8模型处理,且不会通知用户。这一行为被用户发现后,引发了关于其以“安全”为名、行“竞业防守”之实的争议。

Q根据文章,Anthropic将“安全”作为生意的具体策略是什么?

AAnthropic的商业策略是:通过发布安全研究论文来放大AI风险的公众焦虑;随后推出内置“安全分类器”的昂贵产品(如Fable 5)作为“兜底方案”,以此收取高额溢价;最后凭借“最安全AI公司”的人设吸引政府和巨头客户,为其高估值和IPO铺路,形成研究、产品、资本变现的闭环。

Q文章如何比较OpenAI和Anthropic的商业逻辑?

A文章指出,OpenAI的商业逻辑相对“坦荡”,主打“超级应用”和工具生态(如拥有海量用户的ChatGPT),核心是提供工具并赚取流量和规模收益。而Anthropic则专注于贩卖“安全焦虑”,通过将自己塑造为“唯一负责任”的AI公司,来吸引对风险高度敏感、愿意为“不出事”支付溢价的政府和大型企业客户。

QAnthropic的道歉声明被文章认为改变了什么本质?

A文章认为,Anthropic的道歉声明并未改变其商业本质。其改变仅仅是将原本“静默降智”的处理方式,改为“降智前会通知用户”。这被比喻为“给系统打了个补丁”,把“暗中降智”变成了“明着降智”。其以安全为名保护自身商业利益、针对特定用户群(如AI研究者)设限的核心逻辑并未改变。

Q文章对Anthropic的“安全分类器”提出了哪些根本性质疑?

A文章对“安全分类器”提出了两点根本性质疑:第一,其立场不中立,本质是“竞业防守”工具,旨在保护Anthropic自身的商业领先优势,而非用户安全。第二,其有效性存疑,因为如果安全策略真的管用,Anthropic就不需要年年发布论文证明其安全补丁能被AI反向破解。文章认为,分类器的规则本质上是“老板的商业算盘写成了代码”。

你可能也喜歡

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit2 小時前

如何让自己变得让人工智能永远也无法取代

marsbit2 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru5 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru5 小時前

交易

現貨
活动图片