DeepSeek API的涨价方案在8月13日正式官宣,将于8月17日生效,部分模型最高涨幅达到12倍,开发者需要立刻重新计算成本,并调整调用策略。
一、涨了多少:新价格方案正式出炉
DeepSeek于8月13日公布API调价公告,新价格将于2026年8月17日零时生效,并同步引入峰谷定价机制。
峰谷时段划分:高峰时段为北京时间每日9:00-12:00、14:00-18:00,其余时间为空闲时段,闲时价格为高峰时段的一半。
V4-Pro涨幅(高峰时段):缓存命中输入从0.025元涨至0.30元(12倍);缓存未命中输入从3元涨至9元(3倍);输出从6元涨至27元(3.5倍)。
V4-Flash涨幅(高峰时段):缓存命中输入从0.02元涨至0.10元(5倍);缓存未命中输入从1元涨至3元(3倍);输出从2元涨至9元(4.5倍)。
同步上线V4 Pro正式版:8月13日,DeepSeek V4 Pro正式版上线,多项智能体测试逼近顶级模型,同步部署在APP、网页端及API端。


二、为什么突然大幅涨价
本轮涨价并非孤立事件,而是算力压力、行业趋势与商业化需求三重因素叠加的结果。
调用量爆炸式增长:V4-Flash单日Token消耗量突破8万亿,稳居全球调用量第一,服务器与算力资源持续承压。
Agent爆发抬高成本:AI智能体单任务Token消耗是传统对话的百倍以上,KV Cache对显存占用指数级增长,硬件成本急剧攀升。
行业回归理性定价:此前DeepSeek定价仅为海外竞品的1/10至1/20,长期处于补贴状态;阿里云、腾讯云、智谱AI年内已多次提价,全行业正从“价格战”转向可持续盈利。
三、开发者应对策略:四条核心建议
综合成本翻倍甚至翻4倍已成定局,开发者需要从模型选择、调用时段、缓存利用和工具链四个维度重构成本模型。
选择合适模型,避免“大材小用”:简单任务优先使用V4-Flash,复杂推理任务再用V4-Pro;Flash与Pro输出价格相差3倍,选错模型成本翻三番。
利用峰谷价差,错峰调度:将代码审查、数据分析、批量处理等非紧急任务挪至夜间、周末运行;闲时价格为高峰时段的一半,长期错峰可节省30%-50%成本。
深度优化缓存命中率:缓存在住场景价格远低于未命中,建议设计调用逻辑时复用上下文;V4-Flash缓存命中输入闲时仅0.05元/百万Token,而缓存未命中高峰为3元,相差60倍。
引入多模型路由与本地部署:对核心模块可私有部署轻量化模型或引入多模型路由策略,避免单一大模型单一涨价带来的风险。