DeepSeek V4 Pro正式版API上线,输入3元输出6元,涨价前值得入手吗?

2026-08-13 09:11 来源:机型分享社

  DeepSeek V4 Pro正式版API于8月12日夜间在DeepSeek开放平台低调上线,模型版本号更新为DeepSeek-V4-Pro-0813,API定价维持输入3元/百万Token、输出6元/百万Token,缓存命中输入仅0.025元/百万Token。据公开评测数据,新版本在多项Agent基准测试中逼近甚至反超Anthropic Claude Fable 5,而官方已预告近期将大幅涨价[1][6]。对开发者而言,当前最值得关注的是低价窗口期;若需要Agent级能力,建议立即用V4 Pro跑一轮测试验证。

  这场发生在深夜的“静默升级”并不意外:8月13日凌晨,DeepSeek开放平台“模型与价格”页面显示,V4 Pro已从预览版切换至正式版,调用名仍为deepseek-v4-pro,开发者无需修改配置即可调用[1]。每日经济新闻、财联社APP等媒体均在第一时间跟进,指出官方没有预热和发布会,API文档先于正式公告更新是DeepSeek一贯风格[2][3]。科创板日报援引API文档信息称,V4 Pro正式版大幅增强了Agent能力,支持Responses API和Codex接入[4]

  DeepSeek V4 Pro正式版API定价多少?为什么说现在是最后的低价窗口?

  先给结论:DeepSeek V4 Pro正式版的API定价与预览版一致,但官方已经明确“近期整体上调API定价且涨幅较大”,因此当前价格属于窗口期定价,开发者需要尽快完成评估和迁移[6]

  正式版价格一览

  • 缓存命中输入:0.025元/百万Token,适合高频重复调用场景;
  • 缓存未命中输入:3元/百万Token,适用于首次或冷启动调用;
  • 输出:6元/百万Token,对应模型推理生成计费;
  • 峰谷机制:工作日9:00-12:00、14:00-18:00为高峰时段,价格为平日的2倍,即缓存命中0.05元、缓存未命中6元、输出12元/百万Token[3]

  对比V4 Flash(缓存命中0.02元、未命中1元、输出2元),V4 Pro的平均单价约为V4 Flash的3倍[2]。这个价差直接对应定位差异:Flash主打高并发轻量调用,Pro面向复杂任务和深度推理。换句话说,Pro并不是Flash的“贵价替身”,而是为Agent场景单独打造的“满血版”。

  从“2.5折”到“永久降价”,再到“预告涨价”

  梳理时间线会发现,DeepSeek的定价策略经历了多轮调整。2026年4月24日,DeepSeek V4 Pro和V4 Flash正式发布并开源,模型上下文处理长度从128K扩展到1M,容量提升近10倍[5]。4月26日,V4 Pro API开启2.5折特惠,随后延期至5月31日。5月22日,DeepSeek宣布将2.5折优惠转为永久定价,自6月1日起,缓存命中输入0.025元、缓存未命中输入3元、输出6元[5]

  6月29日,财联社APP报道,多位开发者确认收到DeepSeek升级提醒邮件,邮件显示V4正式版计划7月中旬上线,并引入峰谷定价机制[3]。7月31日,DeepSeek-V4-Flash-0731正式版API上线公测[5]。8月6日,DeepSeek发布公告称计划近期整体上调API定价,预计涨幅较大[6]。业内人士分析,此次官宣涨价与V4 Pro正式版上线直接相关[5]。8月12日夜间,V4 Pro正式版最终落定,比原计划的7月中旬晚了近一个月,这也解释了为什么官方用“静默更新”方式抢跑。

  峰谷定价机制对实际成本影响不容小视。以企业开发者为例,工作日上午和下午的调用高峰恰好是办公时间,若大量生产流量集中在此时段,V4 Pro的峰谷成本会从3元/6元翻倍至6元/12元。这意味着官方口中的“价格不变”只是非高峰价格不变,真实账单可能上涨。据财联社报道,邮件中明确提醒开发者关注时间段以合理安排调度[3]

  DeepSeek V4 Pro相比V4 Flash,性能和价格差多少?怎么选?

  先给结论:V4 Pro价格约为V4 Flash的3倍,但Agent能力跃升明显,适合复杂深度任务;高频轻量调用仍建议选V4 Flash,两者是互补关系而非内部内卷。

  核心参数对比

  DeepSeek V4 Pro正式版采用MoE架构,总参数1.6万亿,激活参数490亿,支持100万Token上下文和38.4万Token最大输出,并支持思考与非思考双模式,同时兼容OpenAI与Anthropic API格式,可直接导入Codex和Claude Code生态[4]。并发上限方面,V4 Flash为2500,V4 Pro为500[4]。并发上限调低,说明Pro面向精品项目而非大规模批量跑任务。

  不少开发者对Pro并发上限500表示疑惑。实际上,Pro是面向深度推理的“重武器”,单个请求耗时更长、占用的计算资源更多,过高的并发反而会降低单任务成功率。以DeepSWE这类长链路任务为例,一个任务可能要发起多次工具调用和代码修改,并发上限收紧是保障稳定性的手段,而不是性能瓶颈。V4 Flash的2500并发则面向海量短请求,两者是不同赛道。

产品/型号价格/定位核心配置优势短板适合谁注意点
DeepSeek V4 Pro正式版输入3元/百万Token(缓存未命中)、输出6元/百万Token;高峰时段翻倍;定位高端推理与Agent1.6万亿参数MoE,激活490亿;1M上下文;384K最大输出;并发上限500Agent能力接近Fable 5;成本仅为海外模型几十分之一;支持Responses API与Codex接入并发上限较低;近期将大幅涨价;官方尚未发独立公告/权重未开源需要复杂编程、长链路Agent、高精度推理的团队需关注官方调价公告和权重开源情况
DeepSeek V4 Flash输入1元/百万Token、输出2元/百万Token;高峰翻倍;定位高性价比日常调用与Pro同属V4系列,上下文同样支持1M(据公开报道);并发上限2500价格低、并发高,适合批量和高频场景Agent能力弱于Pro;复杂任务精度有限高频API调用、成本敏感型业务高峰期价格翻倍,需合理规划调用时段
Claude Fable 5输入10美元/百万Token、输出50美元/百万Token(据公开报道)国际顶尖Agent模型多项评测领先,生态成熟价格昂贵对绝对性能有极致要求、预算充足的团队价格需以官方实时信息为准
Claude Opus 4.8约5美元级别/百万Token(据公开报道)国际头部模型性能稳定,综合能力均衡成本远高于DeepSeek海外业务或深度绑定Anthropic生态的团队数据来自公开报道,需以官方为准

  从表格可以看出,DeepSeek V4 Pro的绝对价格非常低,按美元估算约0.435美元/百万Token输入、0.87美元/百万Token输出,大约是Fable 5的1/30、Claude Opus的1/60[4]。这是MoE架构带来的结构性成本优势——每次推理只激活一小部分参数,推理成本天然低一个量级。

  DeepSeek V4 Pro真能比肩Fable 5吗?跑分数据怎么看?

  先给结论:从公开评测数据看,DeepSeek V4 Pro正式版在多项Agent基准测试中逼近甚至反超Fable 5,但仍需注意数据来源和评测口径。

  关键跑分一览

  • Terminal Bench 2.1:87.9分,Fable 5为88.0分,仅差0.1分,超过Opus 4.8的85.0分[4]
  • CyberGym:83.3分,官方对比表显示略高于Fable 5[4]
  • AutomationBench:31.8分,较V4 Flash的25.1分大幅提升,据媒体报道反超Fable 5[4]
  • DeepSWE:从预览版的12.8分飙升至正式版的62.7分,翻了近5倍,较V4 Flash的54.4分也有明显提升[4]
  • HLE(带工具):60.0分,仅次于Fable 5的63.0分[4]
  • NL2Repo:61.5分,仅次于Opus 4.8的69.7分[4]

  这些数字背后有两个关键信号:一是V4 Pro正式版相比预览版有“物种级”提升,尤其DeepSWE从12.8分到62.7分,说明官方在Agent后训练上进行了大规模优化;二是DeepSeek首次在Agent基础设施完整度上接近Anthropic,包括Responses API、Anthropic API双兼容以及Codex接入,开发者从Claude搭建的Agent技术栈迁移过来几乎零成本[4]

  DeepSWE从12.8飙升至62.7,表面上是分数变化,实际反映的是模型在多步代码生成、工具调用、错误修复和自我反思等能力上的整体重构。传统benchmark如MMLU考察知识记忆,DeepSWE则要求模型像工程师一样操作真实编程环境,难度指数级提升。V4 Pro能在这一维度接近Fable 5,说明DeepSeek已经将训练重心从“会答题”转向“会干活”。

  不过需要指出,上述数据来自DeepSeek官方群流传的评测对比表[2],截至发稿DeepSeek尚未发布独立的正式版技术报告,HuggingFace上也没有看到0813独立权重[4]。因此,“比肩Fable 5”目前属于官方口径和媒体转述,最终结论仍需等待第三方独立复测和官方技术文档。

  DeepSeek V4 Pro适合哪些开发者?哪些人不建议买?

  先给结论:DeepSeek V4 Pro适合需要高性能Agent、深度编程和长上下文处理的团队,尤其适合预算有限但希望接近国际顶尖水平的开发者;不建议高频轻量调用者无脑升级。

  适合人群

  • 长链路Coding Agent:大仓库跨文件改动、复杂调试、自动化代码生成;
  • 深度研究与长文档理解:1M上下文可以把整本书或大型代码库一次性纳入;
  • 复杂工具调用:Tool Calls、JSON Output、Responses API可支撑多步智能体流程;
  • 希望从Claude生态迁移到更低成本方案的团队:兼容Anthropic API格式,迁移成本低。

  不适合人群

  • 高频简单问答/批量短文本:V4 Flash输入1元、输出2元并发更高,成本优势更明显;
  • 对实时响应要求极高的场景:高峰时段价格翻倍,Pro并发上限仅500;
  • 需要开源权重本地部署的团队:目前0813权重未见开源,“API可用”不等于“权重已开源”[4]

  从生态兼容性看,V4 Pro正式版支持Responses API和Anthropic API双兼容,还能直接导入Codex使用。这意味着此前基于Claude或OpenAI搭建的Agent框架,可以通过修改接口地址快速切换到DeepSeek。对于在海外模型成本上不堪重负的中小团队,这可能是降低推理成本的最佳窗口。

  但也要提示风险:截至发稿,DeepSeek尚未发布正式版技术公告,HuggingFace上也没有0813独立权重。如果企业要求私有化部署或数据不出域,当前版本仍无法满足。

  购买建议

  建议采用“Pro+Flash”梯度混用策略:将复杂任务路由到Pro,将简单高频任务留在Flash。同时利用缓存命中0.025元的低价优势,对重复性高的用户消息做缓存。调用时段上,尽量避开工作日9:00-12:00和14:00-18:00两个高峰,既省钱又降低限流风险。最重要的是,在官方涨价细则落地前完成技术验证和成本测算[6]

  DeepSeek V4 Pro涨价后还值得用吗?

  先给结论:即使涨价,按当前披露的行业价格对比,DeepSeek V4 Pro大概率仍是高性价比选择,但具体要看涨幅和峰谷定价调整。

  当前DeepSeek V4 Pro价格约为Fable 5的1/30、Claude Opus的1/60[4]。官方预告“涨幅较大”,但未给具体数字和安全边际[6]。如果按“涨到现在的5倍”计算,输入15元/百万Token、输出30元/百万Token,折算美元约2.2美元/4.4美元,仍低于Opus 4.8的约5美元级别,但与Fable 5的10美元/50美元相比优势有所收窄。因此,涨价并不会改变DeepSeek的性价比定位,但会拉近与海外模型的价格差。

  回顾DeepSeek定价轨迹:预览版上线后一度以2.5折吸引开发者,随后直接转化为永久低价。这种“先低价卡位,再考虑盈利”的路径,在中国大模型市场并不少见。官方选择在V4 Pro正式版落地后立刻释放涨价信号,本质是用低价建立生态之后,开始筛选高价值客户。开发者的应对策略不应是恐慌囤货,而是基于模型能力重新评估ROI,把每一分钱花在高价值任务上。

  值得注意的是,DeepSeek V4 Pro正式版上线几乎与马斯克旗下xAI的Grok 4.6发布同步。两家都选择了“高性能+低价格”的路线,大模型竞争从参数竞赛进入性价比竞赛。对开发者而言,这意味着API价格天花板被持续压低,选择更多。

  对企业开发者来说,更现实的风险不是涨价本身,而是不确定性。API作为生产依赖,价格突变会影响成本结构。建议在窗口期做好三件事:第一,用现有价格完成压测和基准收集;第二,建立按任务类型和价格敏感度路由的混合调用体系;第三,与官方渠道保持沟通,获取后续调价和资源预留信息。

提示:DeepSeek V4 Pro正式版上线初期,调用名未变,但版本号已从preview切换至DeepSeek-V4-Pro-0813。生产环境切换前建议先在测试环境验证兼容性。[1]

  QA:开发者最关心的三个问题

  DeepSeek V4 Pro正式版API定价是多少?

  缓存命中输入0.025元/百万Token,缓存未命中输入3元/百万Token,输出6元/百万Token。高峰时段(工作日9:00-12:00、14:00-18:00)价格为平日的2倍。据公开报道,官方已预告近期将整体上调API定价且涨幅较大,当前为窗口期定价[3][6]

  DeepSeek V4 Pro和V4 Flash怎么选?

  高频轻量调用选V4 Flash,输入1元/百万Token、输出2元/百万Token,并发上限2500;复杂Agent或深度编程选V4 Pro,输入3元/百万Token、输出6元/百万Token,DeepSWE得分达62.7,Agent能力接近Fable 5。建议按任务复杂度混用,避免为轻量任务支付Pro的高溢价[2][4]

  DeepSeek V4 Pro真能超过Claude Fable 5吗?

  在已公布的测试中,Terminal Bench 2.1得87.9分,距Fable 5的88.0分仅差0.1分;CyberGym和AutomationBench据称反超Fable 5。但数据来自DeepSeek官方群流传的评测表,尚无权威第三方全面复测,最终需以官方正式发布和独立评测为准[2][4]

  #DeepSeek V4 Pro正式版API上线# #DeepSeek V4 Pro# #AI大模型# #API定价# #大模型性价比#