# Anthropic的所有文章

在 HTX 新闻中心浏览与「Anthropic」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

Anthropic 正式发布了 Claude Sonnet 5 模型,称其为迄今为止最具 Agent 属性的 Sonnet 模型,能够在制定计划、使用工具(如浏览器、终端)方面自主运行,其能力水平接近数月前需要更大、更昂贵模型(如 Opus 4.8)才能达到的程度。 相比前代 Sonnet 4.6,Sonnet 5 在推理、工具使用、编程和知识工作等关键维度性能有显著提升。在智能体搜索和计算机使用评测中,其性能曲线表明,在中等努力程度下成本效率显著提升,在更高努力程度下某些任务性能可媲美 Opus 4.8。用户可根据任务需求灵活调整“努力程度”以平衡成本与性能。 安全评估显示,Sonnet 5 在拒绝恶意请求、抵御提示注入攻击、降低幻觉和谄媚行为率方面整体优于 Sonnet 4.6,但失当行为率仍略高于 Opus 4.8 和 Mythos Preview。该模型未针对网络安全任务专门训练,其开发软件漏洞等危险网络能力显著弱于 Opus 4.8,因此 Anthropic 为其默认启用了网络安全护栏。 定价方面,即日起至2026年8月31日提供尝鲜价:输入每百万token 2美元,输出每百万token 10美元。之后恢复为标准定价:输入3美元,输出15美元。Anthropic 同步上调了各平台的速率限制以适应更高“努力程度”模式。需注意,Sonnet 5 采用了新tokenizer,相同内容映射的token数量约为以前的1.0-1.35倍,尝鲜价旨在使过渡期整体使用成本大致持平。 开发者上手反馈称其速度很快且针对Agent优化,在浏览器使用场景下抵御提示注入攻击的能力(成功率仅0.93%)显著优于Opus 4.8(31.5%)和Sonnet 4.6(50.7%)。但也有分析指出,由于token使用量增加,其每项任务运行成本约为2.29美元,比Sonnet 4.6高约2倍,也比Opus 4.8高出约15%,成为运行成本最高的模型之一。

marsbit07/01 00:35

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

marsbit07/01 00:35

Claude Code官宣下一版大升级,你在聊天,后台把活干完了

Claude Code 即将推出重大升级,未来版本将默认让子智能体在后台运行。这意味着用户在与 Claude 聊天讨论时,后台的子智能体可以同步执行如代码重构、测试、提交拉取请求等任务,真正实现“边聊边干活”。用户只需在对话结束后查看结果,并可随时将特定智能体切换到前台。 这一改进标志着 Claude Code 正从传统的问答式工具演变为能并行管理多条任务线的工作流引擎。其设计哲学是“不是聊天,是基建”。此前,Anthropic 已陆续推出了定时任务(Routines)和动态工作流(Dynamic workflows)功能,允许将复杂任务编排成脚本,调度大量子智能体协作完成。此次更新是将这些能力打包为开箱即用的默认行为。 实际影响显著。据报道,Claude Code 已将 Anthropic 内部工程师的有效产出提升至实际人数的三倍,导致公司更需要能决定“写什么代码”的产品思考者,而非单纯写代码的工程师。Spotify 的案例更具说服力:其超过2000万行的代码库中,73%的拉取请求由 AI 辅助完成,部署频率提升75%以上。工程副总裁可同时管理多个后台智能体并行工作,非工程师也能通过自然语言描述来生成端到端原型。 核心转变在于,当后台智能体成为标配,工程师的核心价值将从“编写代码”转向“决策与判断”——即思考下一步做什么,并评估结果是否正确。这预示着 AI 编程工具正进入一个以工作流自动化和智能协作为特征的新量级。

marsbit06/30 09:33

Claude Code官宣下一版大升级,你在聊天,后台把活干完了

marsbit06/30 09:33

GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?

近日,AI领域两大巨头OpenAI和Anthropic的最新顶级模型遭遇重大监管介入。OpenAI刚刚推出的GPT-5.6系列被拆分为Sol(前沿模型)、Terra(均衡模型)和Luna(经济模型)三个版本。其中性能最强的Sol版本并未全面发布,其访问权限被限制在“获批名单”内,绝大多数用户需等待数周才能逐步使用。此举源于监管机构在全美AI安全框架落地前,对具备“类似Mythos”能力的尖端模型进行预先管控。 在此之前,Anthropic的Fable 5模型经历了更剧烈的风波。该模型发布仅72小时后即被全球禁用,原因是其底层技术Mythos在一次闭门演示中展示了强大的网络攻击能力,例如能找出银行系统漏洞并清空账户。经过安全审查,Mythos 5仅向极少数“信任伙伴”有限开放。据报道,即将回归的Fable 5将是“阉割版”,安全护栏被大幅加强,可能导致能力下降和用户体验受限。 行业观察指出,严格的监管可能迫使AI公司对模型进行“脑叶切除”般的深度限制,以通过安全审查。这引发了开发者对“货不对板”的担忧:用户最终获得的可能是一个能力被严重削弱、反应僵化的“傀儡”,而非当初期待的“天才”。同时,模型的获取方式也可能从“付费即用”变为需要严格身份验证或额外收费。这一系列事件标志着AI发展进入“算法配给制”时代,引发对创新与安全平衡的广泛讨论。

marsbit06/29 08:37

GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?

marsbit06/29 08:37

活动图片