DeepSeek-V4 API峰谷定价,V4-Pro商用
DeepSeek-V4 系列 API 今起实行峰谷定价,V4-Pro 转正商用
定价机制正式切换
深度求索官方公告确认,DeepSeek-V4 系列 API 的全新定价已于今日零点正式生效。与此同时,V4-Pro 结束测试阶段,全面转为正式版商用服务。本次调价最显著的变化,是取消了此前长期使用的统一计费模式,转而采用行业少见的“算力错峰分级计价”方案:高峰时段收费直接翻倍,空闲时段则给出半价优惠。
峰谷时段与价格明细
根据官方规则,每日 9:00-12:00 与 14:00-18:00 被划为高峰时段,其余时间全部属于空闲时段。计费单位统一为 元 / 百万 tokens。两款模型的完整价格如下:
| 模型 | 时段 | 输入缓存命中 | 输入缓存未命中 | 输出 |
|---|---|---|---|---|
| V4-Flash | 空闲 | 0.05 | 1.5 | 4.5 |
| V4-Flash | 高峰 | 0.10 | 3.0 | 9.0 |
| V4-Pro | 空闲 | 0.15 | 4.5 | 13.5 |
| V4-Pro | 高峰 | 0.30 | 9.0 | 27.0 |
注:高峰时段价格均为空闲时段的两倍。
两款模型均支持工具调用、Responses API、Anthropic 兼容接口、对话续写以及 FIM 补全,最大上下文输出长度达 384K。
错峰调度背后的算力逻辑
峰谷定价的核心目的在于优化算力资源调配,引导开发者错峰部署任务。通过市场化价格杠杆,平台希望平抑高峰期的算力负载,从而缓解此前因请求量激增导致的服务不稳定问题,整体提升服务可用性。
具体而言:
- 高峰时段:价格翻倍,适合实时性要求高的任务;平台通过在高峰时段增收费用,抑制部分非必要请求,为关键业务留出资源。
- 空闲时段:价格减半,适合批处理、离线分析、夜间数据挖掘等非实时任务;开发者可以充分利用闲置算力,降低单位成本。
这种定价策略与电力行业的“峰谷电价”逻辑相似,通过价格信号让用户自发调整使用节奏,最终使算力资源配置更加平滑。
对开发者的影响
两款 V4 模型原生适配长文本解析、代码开发、智能体部署与企业批量推理等商用场景,384K 超长上下文可覆盖绝大多数生产需求。对开发者而言,将非实时任务调度至空闲时段运行,有望在不牺牲效果的前提下显著降低调用成本。
例如,一个需要大量调用 V4-Pro 进行夜间数据处理的团队,若将任务从高峰时段移至空闲时段,理论上最高可节省 50% 的 Token 费用。这种成本优势将鼓励更多开发者在架构设计时引入异步任务队列与批量调度机制。
行业意义
此次调整也标志着 DeepSeek 从早期“低价抢占市场”的策略,正式转向“精细化运营”阶段。通过价格杠杆引导用户行为,既有助于维护服务稳定性,也为后续的容量规划提供了更清晰的信号。随着大模型 API 市场竞争日趋激烈,预计将有更多厂商跟进类似的动态定价模式。
总之,峰谷定价是 DeepSeek 在商业化道路上的一次重要尝试,对开发者和平台本身都是双赢的选择。