2026年8月17日零时起,DeepSeek API正式启用峰谷定价新方案,旗舰模型V4 Pro高峰时段输出价格从6元涨至27元/百万tokens,最高涨幅达1100%,持续多年的“白菜价”时代正式落幕。

  一、各档位具体涨幅:V4 Pro与V4 Flash全面上调

  V4 Pro缓存命中输入:高峰价0.30元/百万tokens,较原价0.025元上涨1100%,为全系最高涨幅

  V4 Pro缓存未命中输入:高峰价9元/百万tokens,涨幅200%,原价3元

  V4 Pro输出:高峰价27元/百万tokens,涨幅350%,原价6元

  

  • 模型
  • 计费项
  • 涨价前(元)
  • 高峰价(元)
  • 涨幅
  • V4 Pro输入(缓存命中)0.0250.30+1100%
  • V4 Pro输入(缓存未命中)39+200%
  • V4 Pro输出627+350%
  • V4 Flash输入(缓存命中)0.020.10+400%
  • V4 Flash输入(缓存未命中)13+200%
  • V4 Flash输出29+350%

  二、开发者实际成本变化:不同使用模式差异显著

  重度高频开发者:有用户反馈日常调用V4 Pro为主,月均花费约100元,涨价后预算需提升至300-400元甚至更高

  高峰时段调用者:以3800万tokens真实账单为例,费用从2.43元升至高峰时段17.44元,增幅超6倍

  错峰调用者:若将任务移至空闲时段,上述账单可降至8.72元,成本接近减半

  缓存命中优化:V4 Pro缓存命中输入虽涨幅最高,但绝对价格从0.025元升至0.15元(闲时),绝对值仍低,高频重复请求场景下缓存策略价值凸显

  三、峰谷定价机制:算力资源的“电价式”调节

  计费时段:高峰时段为北京时间9:00-12:00、14:00-18:00,其余为空闲时段,闲时价格统一为高峰的一半

  设计意图:官方表示此举旨在更合理调配算力资源,引导开发者将批量任务、离线处理挪至夜间或周末执行,缓解日间算力拥堵

  价格对比:即便高峰涨价后,V4 Pro输出27元/百万tokens,仍显著低于GPT-4o的72元、Claude Sonnet的108元,相对海外旗舰仍具性价比优势