DeepSeek API实施分时计价与商业化调整

2026年8月17日0时起,DeepSeek-V4系列API全新定价方案正式生效。与此同时,DeepSeek-V4-Pro结束测试阶段,全面转为正式版商用服务。此次调整标志着DeepSeek在商业化路径上迈出关键一步,旨在通过价格机制调节日益增长的算力负载。

引入算力错峰分级计价机制

DeepSeek此次取消了统一计费模式,采用了类似于云计算“峰谷电价”的算力错峰分级计价机制。具体规定如下:

  • 时段划分:高峰时段为北京时间每日9:00-12:00和14:00-18:00;其余时段为空闲时段。
  • 计费标准:高峰时段的收费标准较空闲时段直接翻倍,计费单位统一为元/百万tokens。

官方表示,此举旨在引导用户错峰调用,从而提升算力资源的整体利用效率。

具体价格变动与实测影响

根据不同模型和时段,价格涨幅存在显著差异:

  • V4 Pro模型:在高峰时段,每百万tokens缓存命中输入的涨幅最高达1100%(价格为0.3元);缓存未命中输入为9元(涨幅200%),输出为27元(涨幅350%)。空闲时段的价格则分别为0.15元、4.5元和13.5元。
  • V4 Flash模型:高峰时段缓存命中输入价格为0.1元(涨幅400%),缓存未命中输入为3元(涨幅200%),输出为9元(涨幅350%)。空闲时段价格分别为0.05元、1.5元和4.5元。

一名开发者针对具有接近100%缓存命中率的特定场景(如RAG或文档问答)进行了实测。结果显示,在调价后的低峰期,平均单次API调用成本从约0.0082元上涨至0.0165元,涨幅为101.93%。综合百万Token成本从0.0356元上涨至0.0628元,涨幅为76.35%。

行业背景与用户应对

此次调价是2026年以来DeepSeek第四次发布定价调整通知。此前在8月6日,官方曾在API文档中预告将整体上调定价且“预计涨幅较大”。

面对成本增加,部分用户开始寻求替代方案。实测对比显示,Mistral AI部分模型价格约为0.25美元/1M tokens;Groq提供的Llama 3.1 70B价格约为0.59美元/1M tokens;国产模型GLM-4-Air在ModelScope上的价格约为1.5美元/1M tokens。此外,部分用户考虑通过海外代理商获取折扣或部署Llama 3.2、Qwen2.5等开源模型以降低长期成本。