全球程序员都在给Anthropic白送钱!官方终于看不下去了
Anthropic官方发布博客,针对开发者使用Claude Code时可能产生的不必要高额费用,总结了六条核心省钱建议:
1. 任务完成后及时使用 `/clear` 清理对话,避免无关历史占用上下文。
2. 对话开始时固定好模型和推理强度,中途切换会导致提示缓存失效,需全价重新计算历史。
3. 使用 `@` 引用文件,而非手动输入路径,可避免Claude进行工具调用和试探性读取,减少上下文累积。
4. 为输出冗长的命令(如运行测试)添加静默参数,减少输出内容对上下文的占用。
5. 在会话缓存仍有效时(如休息前)进行 `/compact` 压缩对话,成本仅为十分之一。
6. 将产生大量输出的任务交由子Agent处理,其独立上下文不会污染主对话。
文章解释了费用产生的机制:输入token(预填充)成本较低,输出token(解码)成本约为其5倍。模型(Opus/Sonnet/Haiku)和推理强度直接影响单价和token数量。
**提示缓存是关键的省钱杠杆**:若请求前缀与之前完全相同,服务器可加载缓存结果,读取成本仅为正常输入价的10%。但切换模型、改变推理强度、执行压缩、缓存过期等操作都会导致缓存失效。
此外,对话历史会因不断追加文件内容和命令输出而“变胖”,导致后续每轮对话成本呈接近平方级(O(n²))增长。除了上述建议,还可使用 `/rewind` 回退无效轮次以保住前面缓存。
文章指出,管理token开销正成为AI时代开发者的新技能,关系到使用效率和成本控制。Anthropic自身大量使用AI编写代码,精细的成本管理至关重要。
marsbit5 小時前