DeepSeek在8月内连续两次调整API计费规则——先是在8月17日大幅上调价格并引入峰谷定价,接着在8月23日宣布周末全天按低谷价收费,这轮“先涨后调”的背后,是算力成本承压、需求爆发与行业告别低价内卷三大因素叠加的结果。
一、算力成本倒逼,低价模式难以为继
硬件与运营成本刚性上涨:高端GPU及HBM显存供给持续紧张,硬件折旧、电力、机房运维构成刚性支出,调用量越大亏损压力越突出。
单次推理消耗极高:大模型每次API调用都实打实消耗GPU资源,复杂的Agent任务算力消耗可达普通对话的百倍。
长期亏损不可持续:此前低价策略主要依靠资金补贴,随着调用规模爆发式增长,“烧钱换流量”的模式难以为继。官方将调价归因于“更合理地配置资源、提升服务稳定性”。
二、需求爆发式增长,算力挤兑倒逼价格杠杆
调用量指数级攀升:DeepSeek-V4-Flash单日Token处理量一度突破8万亿,在全球聚合平台OpenRouter周榜以7.22万亿Token登顶。
Agent落地放大消耗:智能体任务需反复调用模型、查询数据库、运行程序,单次任务算力消耗可达普通对话百倍,高峰时段算力挤兑威胁服务稳定性。
峰谷定价即“算力拥堵费”:通过价格杠杆把非紧急任务引导至闲时执行,高峰高价抑制日间并发,本质是削峰填谷。
三、行业集体转向,从价格战走向价值定价
并非孤例:今年以来阿里云、腾讯云、百度智能云、智谱AI等头部厂商已集体调价,腾讯云年内两次涨价,智谱AI完成三次API调价。
行业均价明显抬升:摩根士丹利研报显示,2026年第二季度国内大模型平均API输入价格升至每百万Token 4.9元,输出21.9元,较2025年第一季度分别上涨约48%和80%。
从“低价获客”转向“价值定价”:中银证券指出,模型能力提升及付费模式逐步成熟,将推动行业改善AI服务的商业闭环;高盛亦判断国内大模型竞争正回归理性。