2026年8月,深度求索(DeepSeek)正式推行API峰谷调价,旗舰模型DeepSeek-V4-Pro高峰时段每百万tokens输出价由6元升至27元,涨幅达350%,缓存命中输入价涨幅最高达1100%[1]。这一价格调整并非孤例,而是国产大模型集体告别“白菜价”时代的标志性事件。本文从算力供需、成本倒挂、行业盈利阶段等角度,深度解析DeepSeek“峰谷调价”背后的逻辑与影响。
一、DeepSeek为何突然推出峰谷调价,涨幅最高达1100%?
核心结论:直接原因是算力供需严重失衡,Agent规模化落地导致单次任务Token消耗激增,DeepSeek-V4-Flash单日处理Token量一度达8万亿,算力挤兑威胁服务稳定性,调价是必要的价格杠杆。
根据官方公告,新价格于2026年8月17日生效,采用峰谷定价:高峰时段(北京时间9:00—12:00、14:00—18:00)价格是低谷时段的两倍;低谷时段价格减半。仅一周后,8月23日DeepSeek进一步优化,周末全天统一按低谷价计费[2]。这种“像水电一样分时计价”的策略,本质是通过价格信号引导非紧急任务错峰运行,缓解算力挤兑。
具体涨幅:以V4-Pro为例,高峰时段缓存命中输入从0.025元/百万tokens涨至0.3元,涨幅1100%;输出从6元涨至27元,涨幅350%;缓存未命中输入从3元涨至9元,涨幅200%。低谷时段价格则为高峰的一半:输出13.5元,输入4.5元,缓存命中输入0.15元[1]。
OpenCode CEO的公开分析揭示了更直观的算力压力:DeepSeek v4 Flash在8月1日上线后,仅两周内其日Token使用量从3万亿暴涨至18万亿,增长6倍,相当于再造一个OpenRouter的全部日流量。据估算,OpenCode这部分用量可能已占DeepSeek总调用量的30%–50%,单日消耗约10万亿Token,约需1000张B300 GPU或7000张H100 GPU才能支撑[3]。这种爆发式增长直接导致原有基础设施不堪重负。
二、算力承压到底有多严重?OpenCode单日10万亿Token缺口如何填补?
核心结论:硬件成本(高端GPU、HBM显存)与电力成本构成刚性支出,此前低价依赖资本补贴,长期亏损运营不可持续;涨价后OpenCode日Token量已降至峰值一半,但仍需寻找替代供应商填补巨大缺口。
DeepSeek Flash之所以能提供极低价格,很大程度上依靠其定制化基础设施:可缓存远多于普通方案的Token,且缓存保留时间更长。但用户量暴增后,缓存命中率下降,算力成本急剧上升。OpenCode CEO指出,涨价后OpenCode每天仍面临近10万亿Token的缺口,团队正在拼命寻找其他供应商填补[3]。这意味着,即使调价降低了需求,供给缺口依然存在。
算力紧张的宏观背景是:高端GPU(如H100、B300)和HBM显存供应持续紧张,硬件折旧与电力成本构成刚性成本。摩根士丹利研报显示,2026年第二季度中国大模型平均API输入、输出价格同比分别上涨约48%和80%[1]。这并非个别厂商行为,而是行业集体修正。
三、国产大模型集体涨价是否意味着行业进入盈利阶段?
核心结论:涨价不等于盈利。独立模型厂商缺乏云业务交叉补贴,涨价是应对成本倒挂的必然选择,但“盈利阶段”言时尚早;企业级需求价格弹性低于预期,为确定性付费的意愿正在形成,但整体商业闭环仍需重建。
今年以来,智谱AI年内三次上调API价格,Kimi K3输出价涨至100元/百万tokens,腾讯云混元最高单项接口涨幅超460%[1]。然而,这些涨价背后是长期的“以低价换市场”策略,依赖资本补贴维持。一旦资本退潮,成本倒挂立刻暴露。
值得关注的是,智谱AI一季度API定价提升83%,但调用量反而增长400%[1]。这说明企业级客户对价格敏感度较低,更看重模型效果与稳定性。涨价收入若真正用于算力扩容与服务建设,有望形成正向循环。但当前多数厂商仍处于亏损状态,盈利阶段尚未到来。
四、对开发者和企业用户有何影响,该如何应对?
核心结论:短期成本上升,但峰谷调价提供了灵活选择;开发者应关注模型性价比与场景匹配,错峰使用可降低50%成本;企业需评估长期依赖单一供应商的风险,建立多云策略。
对于非实时任务(如离线批量推理、数据预处理),可将任务调度至低谷时段(工作日18:00至次日9:00、周末全天),成本直接减半。以V4-Pro为例,低谷时段输出价仅13.5元/百万tokens,相比高峰27元,节省显著。此外,缓存命中策略可进一步降低成本:缓存命中输入在低谷时段仅0.15元,适合高频重复查询场景。
OpenCode CEO的案例也警示:过度依赖单一模型供应商存在风险。一旦突然涨价或服务中断,用户可能面临巨大迁移成本。建议企业同时接入多个大模型API(如智谱、Kimi、腾讯混元等),根据任务类型和价格波动动态路由。
五、峰谷调价能否解决算力挤兑,未来API价格走势如何?
核心结论:峰谷调价是短期缓解供需矛盾的有效手段,但长期仍需依赖算力基础设施扩容和模型架构优化;未来价格将趋于“价值定价”,高性能模型维持高价,轻量模型低价走量,差异化竞争加剧。
从效果看,DeepSeek涨价后OpenCode日Token量已从峰值18万亿降至不足9万亿,需求抑制效果明显[3]。但算力挤兑的根本解决方案在于:一是增加GPU供给,二是提升模型推理效率(如更高效的缓存、量化、稀疏化)。
展望未来,大模型API价格将不再“一刀切”。高端模型(如DeepSeek-V4-Pro)将维持较高价格,主打企业级高价值场景;而轻量模型(如Flash系列)可能通过技术优化保持低价,覆盖教育、个人开发者等价格敏感用户。行业将从“价格战”转向“价值战”,比拼模型效果、服务稳定性、生态兼容性。
QA常见问题解答
Q1:DeepSeek峰谷调价后,什么时候调用最便宜?
低谷时段最便宜:工作日18:00至次日9:00,以及周末全天。以V4-Pro为例,低谷时段输出价13.5元/百万tokens,仅为高峰时段27元的一半。缓存命中输入在低谷时段仅0.15元,是高峰0.3元的一半。
Q2:国产大模型集体涨价,会不会导致AI应用开发成本失控?
短期内成本上升,但企业级应用可通过错峰调度、缓存复用、多模型组合等方式控制成本。智谱AI一季度涨价83%但调用量增长400%,说明客户愿意为更高价值付费。长期看,算力成本下降(摩尔定律+国产替代)将抵消部分涨价压力。
Q3:DeepSeek涨价后,其他模型厂商会跟进吗?
已有多家厂商跟进:智谱AI年内三次涨价,Kimi K3输出价涨至100元/百万tokens,腾讯混元最高涨幅超460%。摩根士丹利数据显示2026年Q2行业平均价格同比上涨48%-80%,涨价已形成行业共识。
技术要点表
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek V4-Pro | 高峰输出价27元/百万tokens(涨幅350%);缓存命中输入涨幅1100% | 企业级高精度推理、Agent、多模态任务 | 深度用户、企业开发者 | 需在高峰时段(9-12,14-18)使用 | 中新经纬/第1眼视频[1] |
| DeepSeek V4-Flash | 日处理Token量一度达8万亿;价格较前代低5倍 | 轻量级对话、批量处理、个人开发者 | 中小开发者、OpenCode等平台 | 涨价后日Token量下降50% | OpenCode CEO[3] |
| 智谱AI API | 一季度定价提升83%,调用量增长400% | 企业级智能客服、知识库 | 企业客户 | 客户对价格弹性低 | 摩根士丹利研报[1] |
| Kimi K3 | 输出价100元/百万tokens | 长上下文推理、文档分析 | 专业用户 | 成本较高,适合高价值场景 | 新浪AI前沿速递[1] |
| 腾讯混元 | 最高单项接口涨幅超460% | 云计算、行业解决方案 | 腾讯云客户 | 依赖云端生态 | 长江商报[1] |
#DeepSeek #峰谷调价 #大模型API #算力 #AI行业