2026年8月17日零时起,DeepSeek API正式启用峰谷定价新方案,旗舰模型V4 Pro高峰时段输出价格从6元涨至27元/百万tokens,最高涨幅达1100%,持续多年的“白菜价”时代正式落幕。
一、各档位具体涨幅:V4 Pro与V4 Flash全面上调
V4 Pro缓存命中输入:高峰价0.30元/百万tokens,较原价0.025元上涨1100%,为全系最高涨幅
V4 Pro缓存未命中输入:高峰价9元/百万tokens,涨幅200%,原价3元
V4 Pro输出:高峰价27元/百万tokens,涨幅350%,原价6元
- 模型
- 计费项
- 涨价前(元)
- 高峰价(元)
- 涨幅
- V4 Pro输入(缓存命中)0.0250.30+1100%
- V4 Pro输入(缓存未命中)39+200%
- V4 Pro输出627+350%
- V4 Flash输入(缓存命中)0.020.10+400%
- V4 Flash输入(缓存未命中)13+200%
- V4 Flash输出29+350%
二、开发者实际成本变化:不同使用模式差异显著
重度高频开发者:有用户反馈日常调用V4 Pro为主,月均花费约100元,涨价后预算需提升至300-400元甚至更高
高峰时段调用者:以3800万tokens真实账单为例,费用从2.43元升至高峰时段17.44元,增幅超6倍
错峰调用者:若将任务移至空闲时段,上述账单可降至8.72元,成本接近减半
缓存命中优化:V4 Pro缓存命中输入虽涨幅最高,但绝对价格从0.025元升至0.15元(闲时),绝对值仍低,高频重复请求场景下缓存策略价值凸显
三、峰谷定价机制:算力资源的“电价式”调节
计费时段:高峰时段为北京时间9:00-12:00、14:00-18:00,其余为空闲时段,闲时价格统一为高峰的一半
设计意图:官方表示此举旨在更合理调配算力资源,引导开发者将批量任务、离线处理挪至夜间或周末执行,缓解日间算力拥堵
价格对比:即便高峰涨价后,V4 Pro输出27元/百万tokens,仍显著低于GPT-4o的72元、Claude Sonnet的108元,相对海外旗舰仍具性价比优势