新功能
2026-09-08
Anthropic 发布 Claude 降本指南,三招最高省 73% 费用
Anthropic 发布 Claude 降本指南,三招最高省 73% 费用
一句话说清:Anthropic 发布官方降本指南,教开发者用缓存、清提示词"老毛病"、调推理强度三招优化 Claude 开销,实测最高省 73%。
发生了什么
2026 年 9 月 8 日,Anthropic(Claude 母公司)开发者平台团队发布官方文章《Reducing cost and improving performance with Claude Platform》(来源:Anthropic 官方博客,2026-09-08)。
- 核心结论:很多 Claude 应用不是"模型太贵",而是缓存没吃满、提示词背着旧模型时代的"补丁"、推理强度与任务难度不匹配——修正这三处,成本能显著降,效果甚至还能提。
- 三招:① 最大化 Prompt Cache 命中(重复前缀只算一次,缓存读取价可低至 Fable 5.1 的 0.25 美元/百万 token);② 升级到前沿模型后清理提示词"反模式"(如"务必再检查两遍"这类仪式化指令);③ 按任务精准校准 Effort(推理强度)。
- 这三招已封装进 Claude Code 内置的 claude-api skill,三条命令:/claude-api prompt-audit、/claude-api cost-optimize、/claude-api hillclimb。
- 实测(四个公开基准,以 Sonnet 5 为基线):tau2-bench 零售客服约降 73%,LegalBench 约降 58%,OfficeQA Pro 约降 52%,SWE-bench Verified 约降 55%,准确率基本持平或更好。
对我有什么用
- 如果你在用 Claude API 做产品/智能体,这套方法能直接砍账单,而且多数改动是"删废话、调设置",不伤效果。
- 即便你不是开发者,也能理解一个道理:AI 省钱的关键往往是"少做重复和无用功",不是一味换小模型。
- 普通 ChatGPT/Claude 用户暂用不到命令,但可借鉴:长对话里把固定背景放前面、别让 AI 反复"仔细检查"。
我可以怎么做
- 已用 Claude API / Claude Code 的开发者:升级到前沿模型后,先在 Claude Code 里跑
/claude-api prompt-audit扫一遍提示词和工具描述里的"反模式"。 - 想做全面成本审计,跑
/claude-api cost-optimize;有评估集想自动搜最优配置,跑/claude-api hillclimb。 - 自己也能做的:把稳定的系统提示、工具定义放最前;别在系统提示里塞时间戳/随机数(会破坏缓存);非必要时别中途改推理强度。
- 在 Claude Console 和 Cache Diagnostics API 看缓存命中率,定位"哪里没命中"。
温馨提醒
- 这些是给开发者的优化手段,普通网页聊天用户用不上命令;效果因你的具体工作负载而异,需用自己评估集验证。
- "最高省 73%"是特定基准(tau2-bench 零售客服)的结果,不是所有场景都这个数;客服类任务省得多,复杂推理省得少。
- 校准推理强度别一刀切:简单任务用低强度更便宜,难任务才上高强度,盲目调最高反而又慢又贵。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法