DeepSeek V4 Pro正式版API上线:输入3元/百万Token逼近Fable 5,低价窗口还能撑多久?

2026-08-13 09:09 来源:调校览观

  DeepSeek V4 Pro正式版API于2026年8月12日夜间低调上线,版本号更新为DeepSeek-V4-Pro-0813,定价维持输入每百万Token 3元、输出6元,缓存命中输入仅0.025元[1]。该模型在Terminal Bench测评中得分87.9,距国际顶尖模型Fable 5仅差0.1分,DeepSWE编程测试从预览版12.8分飙升至62.7分,而成本仅为海外同级模型的几十分之一[6]。官方已明确预告近期将大幅上调API价格,当前正处于最后的低价窗口期[13]

  一、DeepSeek V4 Pro正式版API是什么?何时何地上线?

  结论:DeepSeek V4 Pro正式版是DeepSeek于2026年8月12日深夜通过官方API文档静默上线的最新旗舰大模型,开发者调用名不变(deepseek-v4-pro),无需修改配置即可从预览版无缝切换至正式版。

  据DeepSeek开放平台8月13日凌晨消息,DeepSeek官方将V4 Pro从预览版正式转正,官方定价页上的模型版本号已更新为DeepSeek-V4-Pro-0813[1]。此次上线延续了DeepSeek一贯的“API先动、官宣在路上”的风格,没有召开发布会,也没有发布单独的技术报告长文,API通道率先开放可用[9]

  DeepSeek V4 Pro正式版的核心规格包括:总参数1.6万亿(MoE架构),激活参数490亿,支持100万Token超长上下文和38.4万Token最大输出[4]。模型支持思考和非思考双模式切换,同时兼容Responses API和Anthropic API格式,可直接导入Codex、Claude Code生态,开发者迁移成本极低[14]

  此次上线时间点颇有深意——几乎与马斯克旗下xAI的Grok 4.6发布同步,两款模型都在主打“高性能+低价格”策略[11]。此前7月31日,DeepSeek刚宣布V4 Flash正式版API上线公测,此次Pro满血跟进,标志着DeepSeek V4系列Flash和Pro两个版本正式版全部完成发布[6]

  二、DeepSeek V4 Pro正式版定价是多少?相比预览版和竞品有何变化?

  结论:DeepSeek V4 Pro正式版定价与此前预览版一致,按每1M Token计算:缓存命中输入0.025元、缓存未命中输入3元、输出6元,约为V4 Flash价格的3倍,但仅为Fable 5的约1/30、Claude Opus的1/60。

  DeepSeek V4 Pro正式版API定价具体如下[1][2]

计费项目V4 Pro正式版价格V4 Flash价格备注
缓存命中输入0.025元/百万Token0.02元/百万Token适合高频重复调用场景
缓存未命中输入3元/百万Token1元/百万Token适用于首次或冷启动调用
输出价格6元/百万Token2元/百万Token对应模型推理生成的计费

  按美元折算,V4 Pro约为$0.435/百万Token输入、$0.87/百万Token输出[8]。作为对比,Fable 5定价为$10/$50每百万Token,Opus 4.8在$5级别——DeepSeek V4 Pro的实际价格大约只有海外同级模型的几十分之一[10]

  值得注意的是,这一低价并非临时促销。今年4月26日DeepSeek曾宣布V4 Pro模型API开启2.5折特惠,优惠期先后延长至5月5日、5月31日;5月22日,DeepSeek正式宣布将限时2.5折优惠转为永久定价,自6月1日起执行现行价格[16]。也就是说,当前输入3元/百万Token、输出6元/百万Token的价格,已经是“永久折扣价”。

  然而,8月6日DeepSeek发布公告,计划近期整体上调API服务定价,预计涨幅较大[15]。官方已明确将引入峰谷定价机制:高峰时段(北京时间工作日9:00-12:00、14:00-18:00)API价格为平时的2倍[3]。若峰谷机制落地,V4 Pro高峰时段缓存未命中输入价格将达6元/百万Token、输出达12元/百万Token[3]

  三、DeepSeek V4 Pro正式版性能表现如何?凭什么敢对标Fable 5?

  结论:DeepSeek V4 Pro正式版在多项主流AI智能体基准测试中逼近甚至反超Anthropic的Claude Fable 5,其中DeepSWE编程测试得分从预览版的12.8飙升至62.7,翻了近5倍,Agent能力实现质的飞跃。

  根据DeepSeek官方群流出的评测对比表,V4 Pro正式版(DeepSeek-V4-Pro-0813)在多个核心基准测试中的表现如下[2][6][8]

  逼近Fable 5的指标:在Terminal Bench测评中,V4 Pro得分87.9,距Fable 5仅差0.1分;HLE(带工具)得分60.0,仅次于Fable 5的63.0。

  反超Fable 5的指标:在AI安全智能体基准测试套件CyberGym中得分83.3,在工作流智能体AutomationBench中得分31.8,均超越Fable 5[6]

  相比预览版的进化:DeepSWE编程测试从预览版12.8分直接飙升至62.7分;Terminal Bench 2.1从82.7升至87.9;NL2Repo从54.2升至61.5;CyberGym从76.7升至83.3;AutomationBench从25.1升至31.8;HLE(带工具)从51.5升至60.0[8]

  这一成绩意味着DeepSeek V4 Pro正式版已经进入全球AI模型第一梯队。有开发者评价:“用别人几十分之一的成本,拿到了对方80%以上的Agent能力。”[10]

  四、DeepSeek V4 Pro正式版的定价策略与市场影响是什么?

  结论:DeepSeek通过“双版本互补+分层定价+预告涨价”的组合策略,精准卡位高端推理与Agent场景,对全球AI大模型定价体系形成冲击。

  从产品矩阵看,DeepSeek V4形成了清晰的互补格局[12][14]

  • V4 Flash:主打高并发、低成本,并发上限2500,适合日常高频调用和轻量编程任务;
  • V4 Pro:面向复杂任务,并发上限500,专为深度推理、长链路Agent、大仓库跨文件改动等场景设计。

  定价上,V4 Pro是Flash的3倍,但性能提升几乎翻倍,性价比曲线相当漂亮[5]。这种“用略高的成本换接近顶配表现”的策略,对需要高吞吐和长上下文的业务来说很有吸引力。

  从行业影响看,DeepSeek V4 Pro正式版的上线传递了三个信号[9][12]

  第一,开源模型的性能天花板被抬高了。此前开源模型在Agent能力上普遍落后闭源模型,但V4 Pro多项测试已逼近甚至反超Fable 5,这意味着开源与闭源的性能差距正在快速缩小。

  第二,价格战从消费端蔓延到企业端。DeepSeek以Fable 5约1/30的价格提供其80%以上的能力,直接冲击了海外大模型厂商的定价体系。“硅谷同行看完定价表,心情估计不太美丽。”[10]

  第三,Agent基础设施的完整度摸到了国际头部水平。1M上下文+384K输出+Responses API+Anthropic API双兼容+Codex接入,意味着开发者用Claude搭建的Agent技术栈,切换到DeepSeek几乎零迁移成本[10]——这是DeepSeek第一次在Agent基础设施完整度上摸到Anthropic的水平。

  五、DeepSeek V4 Pro适合哪些应用场景?选型时要注意什么?

  结论:DeepSeek V4 Pro正式版最适合长上下文理解、复杂Agent任务、深度编程和工具链调用等高难度场景;选型时应结合并发限制、峰谷定价和即将到来的涨价因素综合决策。

  基于V4 Pro的技术特性,以下场景最具应用价值:

  • 长文档智能处理:100万Token上下文可一次处理数十万字的文档,适合法律、金融、学术研究等领域的深度分析;
  • 复杂Agent编程:DeepSWE得分62.7,意味着在真实软件工程场景中,V4 Pro已具备相当强的代码理解与生成能力;
  • 多步骤工具调用:支持Tool Calls、Responses API,可构建复杂的Agent工作流;
  • 跨平台开发迁移:兼容OpenAI与Anthropic接口,可直接导入Claude Code、Codex生态,降低切换成本[14]

  开发者在选型时需注意以下几点[14]

  一是并发上限。V4 Pro并发上限仅500,远低于Flash的2500,不适合大规模批量跑任务,更适合精品项目。

  二是峰谷定价风险。虽然目前非高峰时段价格未变,但高峰时段(工作日9:00-12:00、14:00-18:00)价格将翻倍,对办公时段高频调用的企业而言实际成本会增加[3]

  三是涨价预期。官方已明确预告“近期整体上调API定价且涨幅较大”,当前价格是窗口期定价[13]。建议有预算的团队尽快用测试集跑一轮,提前规划用量[5]

  四是开源进度不确定。截至发稿,DeepSeek尚未发布独立的正式版公告,HuggingFace上也未看到0813独立权重,“API可用”不等于“权重已开源”[14]

  六、技术要点表

技术/产品核心指标应用场景影响对象限制条件信息来源
DeepSeek V4 Pro正式版总参数1.6万亿,激活490亿,上下文1M,最大输出384K复杂推理、长文档、Agent编程AI开发者、企业用户并发上限500DeepSeek开放平台[4][9]
Terminal Bench87.9分(Fable 5为88.0)终端Agent能力测评大模型厂商、开发者差距0.1分科创板日报[7]
DeepSWE编程测试62.7分(预览版12.8)真实软件工程编程AI编程工具用户翻近5倍礼哥说科技[4]
API定价输入3元/百万Token,输出6元/百万Token企业API调用全球开发者官方预告近期大幅涨价每日经济新闻[1]
峰谷定价机制高峰时段价格为平时2倍企业API调用办公时段调用用户工作日9-12点/14-18点财联社[3]

  七、QA:关于DeepSeek V4 Pro正式版API,大家最关心的问题

  Q1:DeepSeek V4 Pro正式版API的定价是多少?

  答:按每1M Token计算,缓存命中输入0.025元,缓存未命中输入3元,输出6元[1]。按美元折算约$0.435/$0.87,仅为Fable 5的约1/30[8]。官方已预告近期将大幅涨价,当前是窗口期价格[13]

  Q2:DeepSeek V4 Pro正式版性能真的接近Fable 5吗?

  答:在Terminal Bench测评中,V4 Pro得87.9分,距Fable 5仅差0.1分;在CyberGym、AutomationBench等测试中甚至反超[6]。DeepSWE编程测试从预览版12.8分飙升至62.7分但也需注意并非所有指标都超越Fable 5,据公开评测数据,HLE(带工具)60.0仍低于Fable 5的63.0[8]

  Q3:开发者现在应该升级到V4 Pro正式版吗?

  答:如果业务涉及复杂Agent任务、长上下文深度推理或跨文件编程,V4 Pro值得尝试——调用名不变,无需改配置即可切换[11]。但如果只是高频轻量调用,V4 Flash(并发2500)性价比更高[12]。考虑到官方已预告涨价,建议先用测试集验证效果并规划用量,具体选型需以官方实时信息为准[5]

  八、接下来的关注点是什么?

  首先,官方正式公告和技术报告的发布。截至发稿,DeepSeek尚未发布独立的正式版公告,也未见0813版本的独立权重开源[14]。技术报告中的详细训练方法和架构设计值得期待。

  其次,涨价时间表和幅度。这是当前最直接影响开发者的变量。8月6日官方公告已预告“涨幅较大”,峰谷定价机制的实施日期将决定开发者的实际成本[15]

  第三,V4 Pro开源计划。DeepSeek V4预览版于4月24日发布并开源,但正式版权重目前尚未在HuggingFace上出现[14]。“API可用”与“权重开源”是两回事,后续进展值得关注。

  第四,国际厂商的应对。V4 Pro几乎与Grok 4.6同步发布,两家都在卷性价比[11]。OpenAI和Anthropic会如何调整定价策略?这将成为下半年AI行业的重要看点。

  总体来看,DeepSeek V4 Pro正式版的上线,是国产大模型在Agent能力上一次颇有分量的进击。从预览版到正式版,DeepSeek在Agent方向押的注开始兑现了[4]。当性能逼近国际顶尖、价格仅为对手几十分之一时,压力无疑来到了海外闭源模型一边。至于国产大模型能否借此追上国际第一梯队,时间会给出答案。

  #DeepSeek V4 Pro# #DeepSeek发布V4Pro正式版# #DeepSeek V4 Pro正式版API上线# #AI大模型# #大模型API定价#