DeepSeek于2026年8月13日晚间正式官宣API大幅涨价,旗舰模型V4 Pro在高峰时段的输出价格飙升至27元/百万tokens,较现行6元暴涨3.5倍,新价格将于8月17日零时生效。此次调价同时引入峰谷定价机制,闲时价格为高峰时段的一半,V4 Flash输出价格同样上涨350%。这是DeepSeek融资后从低价换市场转向商业化运营的标志性动作,也被业内视为国产大模型告别低价内卷、进入价值付费时代的转折点。[1]
DeepSeek涨价到底涨了多少?哪些模型涨幅最大?
先看结论:V4 Pro高峰时段输出涨了3.5倍,缓存命中输入价格最高涨幅达12倍,整体调价幅度在0.5倍至11倍区间。具体到每一档价格,变化如下:
根据DeepSeek官方公告,新价格将于北京时间2026年8月17日00:00正式生效,采用峰谷定价。高峰时段为每日9:00-12:00和14:00-18:00,其余时间为空闲时段,闲时价格为高峰时段的一半。[2]
| 产品/型号 | 价格/定位 | 核心配置 | 优势 | 短板 | 适合谁 | 注意点 |
|---|---|---|---|---|---|---|
| deepseek-v4-pro | 高峰输出27元/百万tokens(涨350%);闲时13.5元(涨125%);缓存命中输入高峰0.3元(涨12倍) | 1.6万亿总参数、49B激活参数、1M上下文、384K最大输出、支持三档推理模式 | Agent能力大幅提升,DeepSWE从预览版12.8分暴涨至62.7分,逼近Claude Fable 5 | 价格涨幅最大,高频调用成本压力明显 | 对模型能力要求高的企业级Agent、复杂编程任务 | 需以官方实时价格为准;高峰时段成本翻倍 |
| deepseek-v4-flash | 高峰输出9元/百万tokens(涨350%);闲时4.5元(涨125%);缓存命中输入高峰0.1元 | 走量型模型,单日Token消耗量突破8万亿,全球调用量位居前列 | 性价比依然优于Pro,适合大规模调用 | 能力弱于Pro,复杂任务需要多次调用 | 中小开发者、高频Agent场景、成本敏感型用户 | 闲时调价可省一半成本,建议错峰使用 |
对比此前的价格,V4 Pro缓存未命中输入从3元涨至高峰9元,输出从6元涨至27元;V4 Flash缓存未命中输入从1元涨至高峰3元,输出从2元涨至9元。[3]值得注意的是,缓存命中输入这一项看似价格绝对值低,但由于Agent类应用普遍采用98%以上缓存命中率,实际综合成本涨幅接近翻倍甚至更高。
为什么DeepSeek突然大幅涨价?算力压力只是表面原因吗?
直接原因是算力紧缺,根本原因是长期低于成本运营难以为继。DeepSeek以往的定价仅为海外竞品的1/10至1/20,属于亏本运营状态。[4]
从算力端看,V4-Flash单日Token消耗量已突破8万亿,全球调用量位居前列,服务器压力肉眼可见。随着Agent应用的爆发,单次任务的Token消耗呈几何级增长——一个复杂的智能体任务可能要反复调用模型,消耗几十万甚至上百万个Token。这种指数级的调用量增长,让算力供给和成本压力持续加大。[5]
从商业端看,DeepSeek在完成融资后,已经进入价值变现阶段。过去依靠低价换市场的模式难以持续,因为训练、推理、电力和服务都需要真实资金投入。长期把价格压到接近成本线,研发和服务迟早会承受压力。[6]
此外,DeepSeek自研的Agent调度框架DSH(DeepSeek Harness)正处于定向小范围内测阶段。该框架能让AI自主完成闭环任务,一旦上线Token消耗量将成倍增加,当前算力储备不足,这也是暂缓发布的重要原因。这也侧面印证了算力缺口已成为大模型迭代和Agent落地的核心瓶颈。[7]
业内观点:DeepSeek涨价不是简单提价,更像是一次基于算力成本与服务质量平衡的结构性调整。低价策略完成使命后,DeepSeek需要用价格信号调节需求、保障服务稳定性。
开发者实际使用成本会增加多少?真实算一笔账
对高频调用Agent场景,综合成本约翻一倍以上;如果集中在高峰时段调用,成本可能变为原来的4倍。这是开发者最需要关注的实际影响。
有开发者以V4 Flash为例,按典型的Agent使用结构(98%缓存命中、1%普通输入、1%输出)进行测算:假设总共100个单位Token,原成本约0.0496元,新价格下(闲时)成本约0.109元,涨幅约119.8%,刚好翻了一倍多。如果叠加高峰时段定价,成本还会再翻一倍。[8]
这一涨幅对不同类型的用户影响差异明显:
- 个人开发者/小团队:如果只是偶尔调用或非高频使用,绝对成本增加有限;但如果依赖Agent自动完成任务,成本压力会明显上升。
- 企业级用户:高频调用场景下,每年API费用可能从数千元涨到数万元,需要重新评估成本预算和技术选型。
- 普通C端用户:网页端和App端的免费使用暂不受影响,官方尚未调整普通用户的免费策略。
有开发者表示,“不便宜了,价格已经和同类模型齐平了”,特别是高峰时段涨价太多,“这样的Pro没有性价比”。也有用户呼吁新的昇腾芯片能尽快充斥市场,让DeepSeek再次降价。[9]
这次涨价对整个AI大模型行业意味着什么?
这是中国大模型行业从价格战转向价值付费的标志性事件。DeepSeek作为行业价格锚点,它的提价客观上给其他国产模型厂商留出了喘息空间。
过去两年,DeepSeek用低价迅速吸引大量开发者,也重新设定了市场对国产模型价格的预期。其他模型每次发布,除了比较能力,都被追问“为什么比DeepSeek贵”。这种价格压力迫使全行业维持在极低利润甚至亏损状态。[10]
从产业链角度看,模型厂商提价反映算力真紧缺,利好上游服务器、光模块、国产芯片等供应商。资本市场对此反应积极,算力租赁和国产算力替代逻辑被进一步强化。[11]
与涨价同步的是,DeepSeek V4 Pro正式版已于8月13日上线。官方数据显示,新模型在多项智能体测试中的表现大幅提升:DeepSWE编程基准从预览版的7.3分暴涨至62.7分,直接超越Claude Opus 4.8;LiveCodeBench 93.5分登顶第一;Codeforces评分3206接近人类顶级程序员水平;Cybergym和AutomationBench两项测试也超越了Anthropic的Claude Fable 5。[12]能力的大幅提升,为涨价提供了一定的价值支撑。
普通用户和开发者现在应该怎么办?
核心建议:能错峰就错峰,能优化调用结构就优化,Agent场景需要重新算账,不要盲目切换但也不必恐慌性囤货。
对于开发者,建议从三个维度应对:
- 调用时段优化:利用峰谷定价机制,把非实时任务安排在闲时(18:00至次日9:00)批量处理,可节省约一半成本。
- 缓存策略优化:提高缓存命中率,减少重复输入,充分利用缓存命中输入相对低价(高峰0.3元/百万tokens)的优势。
- 模型选型匹配:简单任务用V4 Flash,复杂Agent任务用V4 Pro,避免大材小用。Flash闲时输出4.5元/百万tokens,相比Pro高峰27元有6倍价差。
对于普通用户,目前网页端和App端免费使用未受影响,此次调价主要影响API开发者,无需过度担忧。
QA:关于DeepSeek涨价你需要知道的
Q1:DeepSeek涨价后API价格具体是多少?
新价格于2026年8月17日零时生效,采用峰谷定价。V4 Pro高峰时段输出27元/百万tokens(涨350%)、闲时13.5元(涨125%);V4 Flash高峰输出9元/百万tokens(涨350%)、闲时4.5元(涨125%)。高峰时段为每日9:00-12:00和14:00-18:00。据公开报道,整体涨幅区间为0.5倍至11倍。[1]
Q2:为什么DeepSeek突然大幅涨价?
直接原因是算力紧缺——V4-Flash单日Token消耗量突破8万亿,全球调用量第一,服务器压力巨大。根本原因是长期低价运营难以为继,定价仅为海外竞品的1/10至1/20,融资后需要商业化变现。此外,自研Agent框架DSH因算力不足暂缓上线,也印证了算力缺口。[4][7]
Q3:DeepSeek涨价后还值得用吗?
取决于使用场景。V4 Pro正式版在Agent和编程能力上大幅提升,DeepSWE从7.3涨到62.7,逼近Claude Fable 5。如果追求顶级模型表现且成本敏感度较低,仍值得用;如果对成本敏感且任务简单,可继续用V4 Flash闲时档,或关注后续国产算力替代带来的降价空间。[12]
#DeepSeek涨价# #DeepSeekAPI调价# #V4 Pro价格# #大模型价格战# #AI算力#