新功能
2026-09-10
DeepSeek 把 flash 系列价格砍回去了,最高降 60%
来源:澎湃新闻
DeepSeek 把 flash 系列价格砍回去了,最高降 60%
一句话说清:DeepSeek 9 月 10 日中午起下调 flash 系列 API 价格,缓存命中的输入价直接降了 60%,经常调用的开发者能省不少。
发生了什么
2026 年 9 月 9 日,DeepSeek 在官方开放平台发布公告:自北京时间 2026 年 9 月 10 日 12:00 起,下调 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 两款模型的 API 定价(来源:澎湃新闻,2026-09-10)。
- 闲时输入(缓存命中)从 0.05 元/百万 token 降到 0.02 元,降幅 60%;
- 闲时输入(缓存未命中)从 1.5 元降到 1 元,降幅约 33%;
- 输出从 4.5 元降到 4 元,降幅约 11%。
- 高峰时段(工作日 9:00–12:00、14:00–18:00)价格仍为闲时的 2 倍,但较此前也有所下调。
这次降价距离 8 月那轮涨价不到一个月,相当于把"缓存命中输入价"砍回了涨价前的水平(输出价仍高于涨价前)。与此同时,DeepSeek 正在测试 V4.1 flash 中间版本,原生支持多模态、更快更便宜。
对我有什么用
- 如果你用 DeepSeek API 做翻译、摘要、客服、批量处理,闲时调用越多、缓存命中率越高,省得越明显(有开发者估算综合成本能降约 40%)。
- 想省成本,就尽量把可复用的长提示词放前面、错峰在闲时跑、提高缓存命中率。
- 注意:输出价并没有完全回到涨价前(仍是每百万 token 4 元,高于此前 2 元),别以为"全免费"了。
我可以怎么做
- 打开 DeepSeek 开放平台(platform.deepseek.com),登录后在"用量/价格"页查看最新价目表,确认 9 月 10 日 12:00 后已生效。
- 把调用时间安排到闲时(晚上、周末)跑,并设置好 prompt caching(把不变的系统提示放最前),提高缓存命中。
- 开发/测试期先小批量试跑,看账单里"缓存命中输入"占比是否升高、单价是否降到 0.02 元。
温馨提醒
- 价格以 DeepSeek 官方开放平台公告为准;本文引用的是 9 月 9–10 日媒体报道(澎湃新闻、第一财经、南方都市报)整理的口径,具体计费以你账户实际扣费为准。
- 高峰时段仍是闲时 2 倍,做大规模调用前先算清峰谷价差。
- 输出价未完全回到涨价前,别被"最高降 60%"的标题误导,真正打到 60% 的只是"缓存命中输入"这一项。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法