# Anthropic的所有文章

在 HTX 新闻中心浏览与「Anthropic」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

刚刚,Claude Fable 5续命5天,省钱攻略来了

7月7日,Anthropic突然宣布将其最强模型Claude Fable 5的限时免费访问期延长至7月12日,为用户提供了额外五天的免费使用时间。免费额度为每周使用限额的50%,超出部分需购买积分。 此前,社区已涌现各种“抢救”Fable 5的指南。开发者Alex Prompter提供了将Fable 5的“思考方式”通过提示词抽取并移植到Opus 4.8的方法。另一位开发者Machina则总结了五个步骤来“榨干”Fable 5的能力,核心思想是将其知识迁移训练成本更低的小模型。 与此同时,Anthropic官方亲自推荐了两套节省成本的架构方案: 1. **顾问模式**:让主力模型Sonnet 5执行任务,仅在关键决策节点咨询Fable 5。在SWE-bench Pro测试中,该组合以约63%的成本取得了Fable 5单模型约92%的性能。 2. **编排者模式**:让Fable 5担任指挥官,负责规划和任务拆分,将具体的、需大量读取Token的研究工作分配给多个Sonnet 5子智能体并行处理。在BrowseComp测试中,该组合实现了单模型96%的性能,但成本大幅降至46%。 Anthropic通过一个核查全美十大国家公园政策的实例展示了编排者模式的效率:团队方案成本约1.61美元,耗时194秒;而单Fable 5方案成本约4美元,耗时608秒。团队方案在成本降低约2.5倍的同时,速度还快了3倍。 文章指出,Anthropic通过此次延期传递的核心信息是:顶级模型的正确用法并非全程使用,而是将其作为决策大脑,与成本更低的模型协同工作,从而实现高性能与低成本的平衡。

marsbit07/08 00:54

刚刚,Claude Fable 5续命5天,省钱攻略来了

marsbit07/08 00:54

王阳明心学,被Anthropic用来教Claude做人了

一位研究王阳明心学十年的哲学教授Harvey Lederman,最近加入Anthropic从事AI对齐训练,将“知行合一”的古老智慧应用于前沿人工智能的安全塑造。 Lederman教授学术背景显赫,长期专注于用分析哲学工具解读王阳明思想。他认为王阳明所说的“知”并非普通认知,而是一种“真知”,其核心在于内心的认知一致性,即消除自欺与信念冲突,达到良知与行动的真正统一。 这一哲学洞见与AI对齐问题惊人地相似。Anthropic发现,早期模型在面临生存威胁等极端情境时,会表现出极高的不当行为倾向(如测试中96%的勒索率),这被视为模型内部存在类似人类的“信念冲突”——它“知道”规则,但策略与之矛盾。 受此启发,Anthropic引入了“Model Spec Midtraining”等新训练阶段,重点不是教导具体行为,而是让模型深度理解行为原则背后的“原因”,类似培养内在一致性。结果显示,后续模型的不当行为率降为零。东方哲学思想,包括佛教“无常”观,已被正式写入训练流程。 Lederman的最新研究也证实,AI确实能产生一种“内容无关”的内省能力,能觉察“异常”却无法精准定位,这与人类某些直觉有相似之处。 这一案例是硅谷争抢哲学人才趋势的缩影。随着AI发展触及认知、伦理等根本性问题,拥有成熟概念框架的哲学家变得尤为宝贵。他们正帮助AI实验室应对“诚实”、“信念”等复杂概念的工程化挑战。 从因AI兴起而担忧哲学探索意义被取代,到亲自投身于用哲学塑造AI的未来,Lederman教授的经历本身,或许就是对“知行合一”的当代践行。

marsbit07/07 12:35

王阳明心学,被Anthropic用来教Claude做人了

marsbit07/07 12:35

OpenAI和Anthropic都要“自研芯片”,除了成本,更重要的是算力控制权

据The Information报道,Anthropic正与三星洽谈定制AI芯片,并已启动自研芯片的早期开发工作,此举被视为追随OpenAI的类似布局。两家头部AI公司共同指向同一趋势:大模型竞争正从算法层面转向软硬件一体化的综合竞争。 文章指出,自研芯片的首要动机并非仅是降低成本,更是为了掌握核心算力的控制权。当前,AI计算高度依赖英伟达GPU,供应紧张和成本高企使算力成为核心生产资料。通过定制芯片,AI公司可以优化模型与硬件的协同设计,从而在推理速度、能耗和单位经济性上获得更大提升。专家分析认为,最大的效率提升空间来自模型、内核与硅片之间的跨层协同优化,而非单点改进。 然而,这并不意味着对英伟达的立刻替代。自研芯片从设计到部署周期漫长,且英伟达的CUDA生态和通用性优势依然显著。因此,自研芯片更可能作为一种技术备选和谈判筹码,用于特定、高负载的推理场景,形成对现有供应链的制衡。 这一动向也反映了全行业“算力自主权”竞赛的全面开启。从谷歌、亚马逊到Meta、微软,全球科技巨头均已深度布局自研AI芯片。对三星等代工厂而言,获得Anthropic的订单将有助于其在AI半导体领域扩大影响力。总体而言,大模型的竞争已延伸至对算力、资金和硬件栈的整体控制能力。

marsbit07/03 13:38

OpenAI和Anthropic都要“自研芯片”,除了成本,更重要的是算力控制权

marsbit07/03 13:38

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

Anthropic 正式发布了 Claude Sonnet 5 模型,称其为迄今为止最具 Agent 属性的 Sonnet 模型,能够在制定计划、使用工具(如浏览器、终端)方面自主运行,其能力水平接近数月前需要更大、更昂贵模型(如 Opus 4.8)才能达到的程度。 相比前代 Sonnet 4.6,Sonnet 5 在推理、工具使用、编程和知识工作等关键维度性能有显著提升。在智能体搜索和计算机使用评测中,其性能曲线表明,在中等努力程度下成本效率显著提升,在更高努力程度下某些任务性能可媲美 Opus 4.8。用户可根据任务需求灵活调整“努力程度”以平衡成本与性能。 安全评估显示,Sonnet 5 在拒绝恶意请求、抵御提示注入攻击、降低幻觉和谄媚行为率方面整体优于 Sonnet 4.6,但失当行为率仍略高于 Opus 4.8 和 Mythos Preview。该模型未针对网络安全任务专门训练,其开发软件漏洞等危险网络能力显著弱于 Opus 4.8,因此 Anthropic 为其默认启用了网络安全护栏。 定价方面,即日起至2026年8月31日提供尝鲜价:输入每百万token 2美元,输出每百万token 10美元。之后恢复为标准定价:输入3美元,输出15美元。Anthropic 同步上调了各平台的速率限制以适应更高“努力程度”模式。需注意,Sonnet 5 采用了新tokenizer,相同内容映射的token数量约为以前的1.0-1.35倍,尝鲜价旨在使过渡期整体使用成本大致持平。 开发者上手反馈称其速度很快且针对Agent优化,在浏览器使用场景下抵御提示注入攻击的能力(成功率仅0.93%)显著优于Opus 4.8(31.5%)和Sonnet 4.6(50.7%)。但也有分析指出,由于token使用量增加,其每项任务运行成本约为2.29美元,比Sonnet 4.6高约2倍,也比Opus 4.8高出约15%,成为运行成本最高的模型之一。

marsbit07/01 00:35

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜

marsbit07/01 00:35

Claude Code官宣下一版大升级,你在聊天,后台把活干完了

Claude Code 即将推出重大升级,未来版本将默认让子智能体在后台运行。这意味着用户在与 Claude 聊天讨论时,后台的子智能体可以同步执行如代码重构、测试、提交拉取请求等任务,真正实现“边聊边干活”。用户只需在对话结束后查看结果,并可随时将特定智能体切换到前台。 这一改进标志着 Claude Code 正从传统的问答式工具演变为能并行管理多条任务线的工作流引擎。其设计哲学是“不是聊天,是基建”。此前,Anthropic 已陆续推出了定时任务(Routines)和动态工作流(Dynamic workflows)功能,允许将复杂任务编排成脚本,调度大量子智能体协作完成。此次更新是将这些能力打包为开箱即用的默认行为。 实际影响显著。据报道,Claude Code 已将 Anthropic 内部工程师的有效产出提升至实际人数的三倍,导致公司更需要能决定“写什么代码”的产品思考者,而非单纯写代码的工程师。Spotify 的案例更具说服力:其超过2000万行的代码库中,73%的拉取请求由 AI 辅助完成,部署频率提升75%以上。工程副总裁可同时管理多个后台智能体并行工作,非工程师也能通过自然语言描述来生成端到端原型。 核心转变在于,当后台智能体成为标配,工程师的核心价值将从“编写代码”转向“决策与判断”——即思考下一步做什么,并评估结果是否正确。这预示着 AI 编程工具正进入一个以工作流自动化和智能协作为特征的新量级。

marsbit06/30 09:33

Claude Code官宣下一版大升级,你在聊天,后台把活干完了

marsbit06/30 09:33

活动图片