DeepSeek API在今天(8月17日)正式完成了大幅涨价,新方案采用“峰谷定价”模式,高峰时段输出价格最高涨了4.5倍,其中旗舰模型V4 Pro的缓存命中输入在高峰时段甚至飙升了12倍。

  一、涨价方案已落地:峰谷定价全面生效

  生效时间:新价格于北京时间2026年8月17日00:00正式生效,同时V4 Pro结束测试转为正式商用。

  定价模式:采用峰谷分时计价,高峰时段(每日9:00-12:00、14:00-18:00)价格为空闲时段的两倍,其余时间及周末执行空闲价。

  V4 Flash涨幅:空闲时段输出从2元涨至4.5元(+125%),高峰时段输出涨至9元(+350%);缓存未命中输入空闲1.5元(+50%),高峰3元(+200%);缓存命中输入空闲0.05元(+150%),高峰0.1元(+400%)。

  V4 Pro涨幅:空闲时段输出从6元涨至13.5元(+125%),高峰时段输出涨至27元(+350%);缓存未命中输入空闲4.5元(+50%),高峰9元(+200%);缓存命中输入涨幅最大,空闲0.15元(+500%),高峰0.3元(+1100%)。

  二、涨价背后的原因:算力撑不住了

  需求爆炸式增长:国内日均Token调用量已达140万亿,较2024年初增长超千倍;DeepSeek V4 Flash单日Token消耗量曾达8万亿,一度超越聚合平台OpenRouter全平台总和,导致服务器容量不足。

  算力成本高企:高端AI芯片产能受限、供应链成本持续上涨,算力资源全面趋紧;DeepSeek官方表示,长期低价策略已使“推理服务的毛利率”承压,涨价是覆盖高昂算力成本的直接手段。

  行业性转向:这不是单一厂商行为,智谱一季度API定价提升83%、腾讯云不到一个月连续两次涨价、Kimi暂停C端订阅——整个行业正从“烧钱换规模”转向可持续商业化。

  

  三、对开发者的实际影响与应对思路

  成本剧增:以日均处理10万条咨询的智能客服为例,仅按基准价计算,月成本已从1200元升至3000元左右,若在高峰时段调用,账单还将翻倍。

  错峰调用最有效:将批量任务、数据清洗、离线分析挪到夜间或周末运行,可直接节省50%的API调用成本。

  缓存优化是省钱利器:DeepSeek缓存命中输入价格极低(Flash仅0.05元/百万Token),通过固定System Prompt、分离变量、复用长文档前缀,缓存命中率可达60%-98%,能大幅抵消涨价影响。

  模型路由降本:简单任务用V4 Flash或开源模型,复杂推理再调用V4 Pro,避免“一刀切”调用造成算力浪费。