DeepSeek于2026年8月宣布API大幅涨价,旗舰模型V4 Pro高峰时段输出价格涨至27元/百万Token,最高涨幅达12倍,却被业界称为“价格屠夫”——因为涨价后的价格在同等性能下仅为海外头部模型的几十分之一。这种“我涨了价你还说我便宜”的定价权,正是DeepSeek作为价格屠夫的最大底气。
DeepSeek这次涨价到底涨了多少?
DeepSeek在2026年8月13日官宣V4 Pro正式版(版本号0813)全端上线,并同步公布新版API定价方案,新方案于8月17日零时起生效[1]。本次调价最核心的变化是引入峰谷定价机制:高峰时段为9:00—12:00、14:00—18:00,闲时价格为高峰时段的一半[2]。
以旗舰V4 Pro为例,高峰时段输出价格由6元/百万Token涨至27元/百万Token,涨幅350%;高峰缓存命中输入价格由0.025元/百万Token涨至0.3元/百万Token,涨幅达1100%;高峰缓存未命中输入价格由3元涨至9元,涨幅200%;闲时输出价格为13.5元/百万Token,涨幅125%[1]。轻量版V4 Flash同步上调,高峰输出由2元涨至9元,涨幅同样为350%[1]。
这是DeepSeek自2026年5月将V4 Pro永久下调至原价25%之后,首次反向大幅提价[1]。从“绝对低价”到“相对低价”的切换,意味着DeepSeek告别以“白菜价换份额”的早期策略,转而以顶级性能和相对海外竞品的显著价差重新定义行业定价基准线。
横向对比显示,即便高峰涨价后,V4 Pro输出价格约为Anthropic Fable 5的1/57,“极致性价比”标签虽被削弱,但相对海外旗舰仍具显著价差[1]。
为什么DeepSeek涨价后仍是价格屠夫?横向对比给出答案
涨价后的DeepSeek依然是全球性价比最高的旗舰模型,而不是涨价的屠夫,而是“相对低价”的新屠夫。
据公开消息,DeepSeek V4 Pro正式版在Agent基准测试中得分25.2,逼近Claude Opus 4.8的25.7分,性能已进入全球第一梯队[3]。但两者的价格差距十分悬殊:Claude Fable 5完成相同基准测试需3.15美元(约22元人民币),而DeepSeek仅需0.03美元(约0.2元人民币)[3]。当模型能力达到顶级,却只卖竞品1/50的价格时,即使涨价后的价格,依然在重塑行业定价基准线。
开发者的实测反馈也印证了这一点:即便调整后价格翻倍,V4 Flash高峰输出9元/百万Token的价格,仍远低于Kimi K3的100元或GLM-5.2的对应定价[3]。有开发者直言:“涨价后的Pro也就相当于GLM-5.2的价格,只要能打就值”[3]。
V4 Pro性能到底提升了什么?能力升级如何支撑涨价值?
本次涨价并非单纯的“坐地起价”,而是能力升级后的价值回归。
V4 Pro正式版全面升级:支持100万Token上下文、最大输出38.4万Token,原生支持OpenAI Responses API与Anthropic API,思考/非思考双模式可切换,Agent工作流能力大幅提升[1][4]。核心Agent能力从预览版大幅跃升——DeepSWE从预览版的12.8飙升至62.7,TerminalBench 2.1拿到87.9分,距全球第一的Claude Fable 5仅差0.1分[1]。性能逼近行业天花板时,定价从“白菜价”调整为“良心价”,是合理的价值回归[3]。
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek V4 Pro正式版(0813) | 100万Token上下文;最大输出38.4万Token;Agent基准25.2分;TerminalBench 87.9分 | 复杂Agent任务、代码生成、长文本推理、多步工具调用 | 企业开发者、AI应用厂商、高频API调用用户 | 高峰时段需排队;算力资源趋紧;价格高于旧版 | DeepSeek官方公告[1];公开评测数据[4] |
| DeepSeek V4 Flash | 高峰输出9元/百万Token;高峰输入3元/百万Token | 轻量级任务、批量处理、对成本敏感的初创团队 | 中小开发者、个人创作者 | 性能弱于V4 Pro;高峰期涨价后性价比优势收窄 | 公开API定价表[2];开发者实测反馈[3] |
| Claude Fable 5(海外对比) | Agent基准25.7分;完成同任务费用约3.15美元 | 对标DeepSeek的海外旗舰模型 | 海外开发者、跨国企业 | 国内访问受限;价格远高于DeepSeek(约57倍) | 公开对比数据[3] |
| Kimi K3 / GLM-5.2(国产对比) | Kimi K3输出定价100元/百万Token;GLM-5.2对应定价高于V4 Pro | 对应国产旗舰模型竞争 | 国产模型用户 | 价格高于DeepSeek;需关注各自生态能力 | 开发者对比实测[3] |
算力紧缺与峰谷定价:涨价是不是因为“供不上了”?
官方公告与业界讨论均指向一个核心事实:DeepSeek的算力资源已高度紧张,涨价本质是算力稀缺的货币化表达,而非单纯的利润驱动。
据市场公开信息,DeepSeek V4-Flash单日处理量一度达8万亿Token,超过OpenRouter平台400多款模型的总和[3]。两万张H系等效芯片训推共用,自建智算中心尚未完全交付,供给瓶颈短期难以消除[1]。高峰时段服务频繁超时,倒逼平台通过价格杠杆调节需求。
新方案引入闲时半价机制,鼓励非紧急任务错峰运行。对时延不敏感的批量推理用户,实际成本涨幅远低于表观涨幅[3]。这意味着涨价并非“一刀切”的收割,而是通过分时定价优化资源配置,让高优先级、高时效需求支付更高溢价,让可延迟任务享受成本缓冲。
“越涨价越用”的底气从哪里来?消费者用脚投票
OpenRouter最新周榜显示,DeepSeek V4-Flash以7.22万亿Token的调用量蝉联全球第一,前五全是国产模型[3]。这证明用户不是因为便宜才用,而是因为好用才留下。
行业已有先例:智谱在2026年一季度API涨价83%,调用量不降反增400%[3]。高盛研报指出,国内AI模型需求持续旺盛,算力资源趋紧,涨价恰是需求过硬的信号[3]。市场消息称,梁文锋在投资者交流中指出,在极低价格区间内开发者对价格弹性几乎为零——“价格即便翻倍,Token消耗量也不会明显下降”[3]。当客户粘性强到“涨价也不走”,才是定价权的终极证明。
涨价后的DeepSeek,开发者和企业应该怎么用?
对于开发者与企业用户,新的峰谷定价机制意味着更精细的调用策略:紧急任务和实时交互场景可接受高峰溢价;离线批量推理、数据清洗、批量内容生成等非即时任务可安排在闲时运行,享受半价优惠[1]。以V4 Pro为例,闲时输出价格为13.5元/百万Token,较高峰价的27元大幅降低50%[1]。
同时,V4 Pro原生支持Responses API和Anthropic API的特性,使迁移成本大幅降低,开发者可以较低成本将工作流从海外模型切换至DeepSeek[1][4]。对时延不敏感的Agent任务,建议优先使用闲时调度+缓存命中策略,可进一步摊薄成本。
产业链影响与后续关注:涨价是更高级的定价权证明
在A股市场,DeepSeek概念股8月13日集体上涨,资本市场对“推理放量带动算力需求”的逻辑给出积极回应[1]。涨价事件传递出明确信号:国产大模型正从“低价换规模”走向“高性价比+技术溢价”的新阶段。
后续值得关注三个方向:一是DeepSeek自建智算中心何时交付,能否缓解算力紧缺;二是涨价后企业客户留存率与新增用户数据,验证“价格弹性趋零”的判断;三是国产模型的定价协同效应,是否会带动整个行业从恶性价格战转向能力定价。
风险提示:本次调价涉及的价格、参数均来自公开报道[1][2][4],具体执行价格需以DeepSeek官方实时信息为准;梁文锋投资者交流内容系市场消息,尚无权威确认[3]。
QA:关于DeepSeek涨价,你关心的几个问题
Q1:DeepSeek V4 Pro涨价后还便宜吗?
还便宜,且是全球性价比最高的旗舰模型。涨价后高峰输出27元/百万Token,但完成同类任务Claude Fable 5需要约22元人民币,而DeepSeek只需0.2元人民币,价格约为海外旗舰的1/50[3]。
Q2:DeepSeek涨价后,开发者应该怎么降低API成本?
利用闲时半价机制。闲时输出价格仅为高峰的一半(V4 Pro为13.5元/百万Token),对非紧急的批量推理任务安排在闲时运行,可显著摊薄成本[1]。
Q3:DeepSeek涨价是否会劝退用户?
从现有数据看不会。V4-Flash调用量单日达8万亿Token,蝉联OpenRouter全球第一;智谱涨价83%后调用量反增400%的行业先例也表明,好产品涨价不会带来用户流失[3]。
#DeepSeek #DeepSeek涨价 #大模型价格战 #AI算力 #V4 Pro