突发,打工版Claude 5来了,人人都能用
突发,Claude Sonnet 5(代号Fennec)正式发布,现已成为所有免费和付费用户的默认模型。这是Anthropic迄今为止Agent能力最强的Sonnet模型,性能直逼旗舰Opus 4.8。
该模型具备自主规划、调用浏览器和终端工具的能力。相较于前代Sonnet 4.6,其在推理、工具使用、编程和知识工作任务上均有显著提升。关键数据包括:SWE-bench Pro得分63.2%,反超GPT-5.5;在“人类最后的考试”中得57.4%,仅落后Opus 4.8约0.5个百分点。
定价方面,API推出限时促销(输入$2/百万tokens,输出$10/百万tokens),8月31日后恢复为标准价(输入$3,输出$15),约为Opus 4.8价格的六成。但需注意,新模型采用了全新分词器,可能带来token数量的小幅膨胀。
安全性能突出:提示注入攻击成功率仅0.19%,与Opus 4.8持平;浏览器注入防御成功率高达99.07%,反超Mythos 5和Opus 4.8;恶意代码注入攻击成功率从Sonnet 4.6的45.26%大幅降至0.29%。
总体而言,Sonnet 5以中端价格提供了逼近顶级旗舰模型的性能,尤其在编程、工具调用和安全性方面表现优异,为开发者提供了一个高性价比的强力选择。
marsbit07/01 07:47