Claude Code到底有多费token?对比实验来了:三大框架最多差30倍
近期一项关于AI Agent框架的对比实验揭示了不同框架在资源消耗上的巨大差异。实验使用同一模型Kimi K3,在Claude Code、Hermes和Kimi Code三个框架上运行28个相同任务。结果显示,任务成功率相近,但Claude Code的Token消耗量远超其他框架——其中位数Token用量高达34万,是Kimi Code(约6.1万)的6倍,极端情况下差距可达30倍。这直接导致成本差异显著:按Kimi K3定价估算,平均单任务成本约为Kimi Code 0.22美元、Hermes 0.28美元、Claude Code则达2美元。
分析指出,Claude Code的高消耗主要源于其设计机制会在多轮交互中反复向模型输入大量历史上下文(包括消息、工具调用及文件内容),导致输入Token激增,而非输出内容更多。实验进一步印证了近期研究趋势:在模型能力趋同的背景下,Agent的编排层(Harness)已成为影响效率和成本的关键因素。有研究显示,仅优化Harness就可使平均任务成本降低41%、延迟缩短44%、Token消耗减少38%,而任务质量保持稳定。
这表明,AI Agent领域的竞争重点正从“能否完成任务”转向“谁能以更高效、经济的方式完成”。未来,评估框架时需引入“Harness税”等成本维度,框架本身的优化能力可能比模型选择更为重要。
marsbit昨天 12:26