docs/ai-coding/cases/deepseek-v4-claude-code.md 第 275-279 行的价格表标注的是「截至 2026-07-24」。8 月 16 日 DeepSeek 把 V4 改成了高峰/空闲两档计费,同时发布期的促销价结束,表里这三行现在偏低 1.5-6 倍(空闲档),高峰档最多差 12 倍。
文章本身已经写了「价格会变化,使用前应再查官方定价页」,所以这不是方法问题,只是数字过期了。之所以提出来,是因为这次不只是数字变了,计费结构也变了——单列表格已经装不下了。
现在的官方价格
官方定价页(2026-08-24 核对),每百万 token 人民币:
|
deepseek-v4-flash |
deepseek-v4-pro |
| 输入(缓存命中)空闲 / 高峰 |
0.05 元 / 0.10 元 |
0.15 元 / 0.30 元 |
| 输入(缓存未命中)空闲 / 高峰 |
1.5 元 / 3.0 元 |
4.5 元 / 9.0 元 |
| 输出 空闲 / 高峰 |
4.5 元 / 9.0 元 |
13.5 元 / 27.0 元 |
官方英文页给的美元价与之一一对应(换算比固定为 6.8182):
|
表中(旧) |
空闲档 |
高峰档 |
| flash 输入(未命中) |
$0.14 |
$0.22 |
$0.44 |
| flash 输入(命中) |
$0.0028 |
$0.007 |
$0.014 |
| flash 输出 |
$0.28 |
$0.66 |
$1.32 |
| pro 输入(未命中) |
$0.435 |
$0.66 |
$1.32 |
| pro 输入(命中) |
$0.003625 |
$0.022 |
$0.044 |
| pro 输出 |
$0.87 |
$1.98 |
$3.96 |
高峰时段为北京时间周一至周五 9:00-12:00、14:00-18:00(UTC 01:00-04:00 和 06:00-10:00),其余时段(含整个周末)为空闲档,价格正好是高峰档的一半。整个周末算空闲是最近才改的,8 月中旬那次调价时周末还是跟工作日一样的。
对文章结论的影响
文中「V4-Pro 是否划算要看缓存命中率和任务长度」这个判断方向没变,但缓存的性价比缩水了:
- 旧价:pro 缓存命中比未命中便宜约 120 倍(0.003625 : 0.435)
- 新价:只便宜 30 倍(0.022 : 0.66)
- flash 从约 50 倍变成约 31 倍
也就是说,靠高缓存命中率把成本压下来的效果,比 7 月那张表看起来要弱一些。Agent 类任务缓存读通常占输入 token 的九成以上,这一行的变化对实际账单的影响比输入、输出两行都大。
另外高峰时段正好覆盖国内工作日的上午和下午——对读这篇文章的人来说,高峰档才是常态,空闲档反而是加班和周末才享受得到的。
建议改法
把表头的「截至」日期更新,并拆成两档:
| API 定价(每百万 token,截至 2026-08-24) | `deepseek-v4-flash` | `deepseek-v4-pro` |
| ----------------------------------------- | ------------------- | ----------------- |
| 输入(缓存未命中)空闲 / 高峰 | $0.22 / $0.44 | $0.66 / $1.32 |
| 输入(缓存命中)空闲 / 高峰 | $0.007 / $0.014 | $0.022 / $0.044 |
| 输出 空闲 / 高峰 | $0.66 / $1.32 | $1.98 / $3.96 |
> 高峰时段为北京时间周一至周五 9:00-12:00、14:00-18:00,其余时段(含周末)为空闲档,单价是高峰档的一半。
顺带一提,官方现在还多了一个 deepseek-v4-flash-vision-exp(支持图片输入,价格与 flash 相同),文章的模型表里没有,可以按需要决定要不要补。
需要的话我可以提个 PR 把这段改掉。
各家模型的缓存读单价我整理在这里,做横向对比时可以参考:https://xyzs996.github.io/llm-api-pricing/
docs/ai-coding/cases/deepseek-v4-claude-code.md第 275-279 行的价格表标注的是「截至 2026-07-24」。8 月 16 日 DeepSeek 把 V4 改成了高峰/空闲两档计费,同时发布期的促销价结束,表里这三行现在偏低 1.5-6 倍(空闲档),高峰档最多差 12 倍。文章本身已经写了「价格会变化,使用前应再查官方定价页」,所以这不是方法问题,只是数字过期了。之所以提出来,是因为这次不只是数字变了,计费结构也变了——单列表格已经装不下了。
现在的官方价格
官方定价页(2026-08-24 核对),每百万 token 人民币:
deepseek-v4-flashdeepseek-v4-pro官方英文页给的美元价与之一一对应(换算比固定为 6.8182):
高峰时段为北京时间周一至周五 9:00-12:00、14:00-18:00(UTC 01:00-04:00 和 06:00-10:00),其余时段(含整个周末)为空闲档,价格正好是高峰档的一半。整个周末算空闲是最近才改的,8 月中旬那次调价时周末还是跟工作日一样的。
对文章结论的影响
文中「V4-Pro 是否划算要看缓存命中率和任务长度」这个判断方向没变,但缓存的性价比缩水了:
也就是说,靠高缓存命中率把成本压下来的效果,比 7 月那张表看起来要弱一些。Agent 类任务缓存读通常占输入 token 的九成以上,这一行的变化对实际账单的影响比输入、输出两行都大。
另外高峰时段正好覆盖国内工作日的上午和下午——对读这篇文章的人来说,高峰档才是常态,空闲档反而是加班和周末才享受得到的。
建议改法
把表头的「截至」日期更新,并拆成两档:
顺带一提,官方现在还多了一个
deepseek-v4-flash-vision-exp(支持图片输入,价格与 flash 相同),文章的模型表里没有,可以按需要决定要不要补。需要的话我可以提个 PR 把这段改掉。
各家模型的缓存读单价我整理在这里,做横向对比时可以参考:https://xyzs996.github.io/llm-api-pricing/