目前 DeepSeek 官方 API 在售的就两个模型,一个是 deepseek-flash(底层是 DeepSeek-V4.1-Flash),一个是 deepseek-v4-pro(对应 DeepSeek-V4-Pro-0813)。老的 deepseek-v4-flash、deepseek-v4-flash-vision-exp 这些名字还能调,但实际已经下线了,请求会被转到 Flash 上,按 Flash 的价格算钱。
两者的定位差别挺明显:flash 便宜、并发高(2500),而且支持图像理解;v4-pro 贵一截、并发只有 500,但输出质量更强,不支持图片输入。两个都支持思考模式、Json Output、Tool Calls,上下文都是 1M,输出最大 384K。
峰谷定价这块,规则很直白:空闲时段就是高峰时段价格的一半。
高峰时段只有工作日的两个区间——周一至周五的 9:00-12:00 和 14:00-18:00(法定节假日不算)。除此之外全是空闲:晚上、中午 12-14 点、周末两天、法定节假日全天,都按空闲价走。注意调休上班的周末也算空闲时段,这点挺良心。
具体单价(每百万 tokens):
- deepseek-flash:输入缓存命中 空闲 0.02 元 / 高峰 0.04 元;缓存未命中 空闲 1 元 / 高峰 2 元;输出 空闲 4 元 / 高峰 8 元
- deepseek-v4-pro:输入缓存命中 空闲 0.15 元 / 高峰 0.30 元;缓存未命中 空闲 4.5 元 / 高峰 9 元;输出 空闲 13.5 元 / 高峰 27 元
所以用法上有个小技巧:能晚上跑的批量任务就别挤在工作日下午,价格直接砍半。另外输入"缓存命中"和"未命中"差了 50 倍,上下文复用做得好的话,成本能压下来一大块,这比挑时段省得还多。
价格这东西官方会调,真掏钱之前还是扫一眼 API 文档那个价格页,以当时的为准。