DeepSeek调价后API使用成本增加了多少?

2026-08-14 05:07 来源:光电寻常栈

  一、新定价机制与核心涨幅

  峰谷分时定价:高峰时段为北京时间9:00-12:00和14:00-18:00,其余为空闲时段,闲时价格为高峰价的一半,新价格将于2026年8月17日零时生效。

  V4-Pro模型涨幅:高峰时段输出价格从原价6元涨至27元/百万Token(上涨350%),缓存命中输入从0.025元飙升至0.30元(涨幅12倍),缓存未命中输入从3元涨至9元(涨2倍)。

  V4-Flash模型涨幅:高峰时段输出价格从2元涨至9元/百万Token(涨4.5倍),缓存命中输入从0.02元涨至0.10元(涨5倍),缓存未命中输入从1元涨至3元(涨2倍)。

  二、不同场景下的成本增加

  轻量级开发者(月调500万Token输出):全部使用Flash且避开高峰,月成本从约300元增至约450元(涨50%);若无法错峰则翻倍至600元以上。

  重度开发者(月调5000万Token输出):Flash模型日常成本约3000元/月,涨价后闲时约4500元,高峰时可达9000元以上,每月新增支出最高达6000元。

  高负载Agent场景:以典型“98%缓存命中+1%输入+1%输出”的调用结构测算,100个单位Token的总成本从0.0496元升至0.109元,涨幅约119.8%,综合成本翻倍以上。

  三、调价原因与行业信号

  算力成本高企:AI应用爆发导致日均Token调用量达140万亿,高端GPU芯片供应紧张,长期低价策略导致“推理服务毛利率”承压,涨价是覆盖高昂算力成本的直接手段。

  商业化转型:此前的“白菜价”策略帮助DeepSeek快速积累开发者生态并登顶全球调用量第一,但无法持续;融资后公司进入商业化阶段,需改善盈利模型。

  行业告别价格战:这标志着国产大模型从“烧钱换市场”转向“价值变现”,智谱、豆包等厂商此前也已跟进调价,算力资源稀缺下的合理定价正成为行业常态。