DeepSeek已正式告别“白菜价”:自2026年8月17日起全面上调API价格并引入峰谷定价,旗舰模型V4-Pro高峰时段输出价格飙至每百万tokens 27元,部分计费项涨幅最高达11倍。
一、开发者成本涨幅有多大
V4-Pro高峰时段涨幅:缓存命中输入从0.025元涨至0.3元(涨1100%),缓存未命中输入从3元涨至9元(涨200%),输出从6元涨至27元(涨350%)。
V4-Flash高峰时段涨幅:缓存命中输入涨400%至0.1元,缓存未命中输入涨200%至3元,输出涨350%至9元。
空闲时段同样涨价:V4-Pro空闲时段输出13.5元、V4-Flash输出4.5元,虽然只是高峰的一半,但仍高于调价前的原价。
开发者实际账单涨幅:一位开发者日均调用7673万Token的案例显示,费用从约2.99元升至7.27元,为原来的2.43倍;若24小时均匀调用,Pro输出加权价约17.4元/百万tokens,较调价前高约191%。
二、峰谷定价规则与错峰空间
高峰时段:工作日北京时间9:00-12:00、14:00-18:00,共7小时,价格为空闲时段的2倍。
空闲时段:其余17小时价格减半;8月23日起周末(周六、周日)全天统一按低谷价计费,不再区分峰谷。
错峰效应有限:实时对话、在线Agent等业务无法避开高峰;只有批量数据处理、代码生成等离线任务可移至夜间大幅降本。
三、涨价背后的行业逻辑
算力供需失衡:DeepSeek单日Token消耗量达8万亿,V4-Flash在OpenCode平台两周内日用量从3万亿增至18万亿,增长6倍,服务器难以承载。
低价模式难以为继:Agent时代单次任务Token消耗从几千飙至几十万,原定价大概率负毛利;GPU、HBM等硬件价格持续高企。
行业集体转向价值定价:智谱年内三次上调API价格、腾讯云两次涨价,国内大模型价格战已基本结束,竞争重心转向技术实力与商业化能力。