DeepSeek V4 Pro正式版API于2026年8月12日夜间低调上线,版本号更新为DeepSeek-V4-Pro-0813,定价维持输入每百万Token 3元、输出6元,缓存命中输入仅0.025元[1]。该模型在Terminal Bench测评中得分87.9,距国际顶尖模型Fable 5仅差0.1分,DeepSWE编程测试从预览版12.8分飙升至62.7分,而成本仅为海外同级模型的几十分之一[6]。官方已明确预告近期将大幅上调API价格,当前正处于最后的低价窗口期[13]。
一、DeepSeek V4 Pro正式版API是什么?何时何地上线?
结论:DeepSeek V4 Pro正式版是DeepSeek于2026年8月12日深夜通过官方API文档静默上线的最新旗舰大模型,开发者调用名不变(deepseek-v4-pro),无需修改配置即可从预览版无缝切换至正式版。
据DeepSeek开放平台8月13日凌晨消息,DeepSeek官方将V4 Pro从预览版正式转正,官方定价页上的模型版本号已更新为DeepSeek-V4-Pro-0813[1]。此次上线延续了DeepSeek一贯的“API先动、官宣在路上”的风格,没有召开发布会,也没有发布单独的技术报告长文,API通道率先开放可用[9]。
DeepSeek V4 Pro正式版的核心规格包括:总参数1.6万亿(MoE架构),激活参数490亿,支持100万Token超长上下文和38.4万Token最大输出[4]。模型支持思考和非思考双模式切换,同时兼容Responses API和Anthropic API格式,可直接导入Codex、Claude Code生态,开发者迁移成本极低[14]。
此次上线时间点颇有深意——几乎与马斯克旗下xAI的Grok 4.6发布同步,两款模型都在主打“高性能+低价格”策略[11]。此前7月31日,DeepSeek刚宣布V4 Flash正式版API上线公测,此次Pro满血跟进,标志着DeepSeek V4系列Flash和Pro两个版本正式版全部完成发布[6]。
二、DeepSeek V4 Pro正式版定价是多少?相比预览版和竞品有何变化?
结论:DeepSeek V4 Pro正式版定价与此前预览版一致,按每1M Token计算:缓存命中输入0.025元、缓存未命中输入3元、输出6元,约为V4 Flash价格的3倍,但仅为Fable 5的约1/30、Claude Opus的1/60。
DeepSeek V4 Pro正式版API定价具体如下[1][2]:
| 计费项目 | V4 Pro正式版价格 | V4 Flash价格 | 备注 |
|---|---|---|---|
| 缓存命中输入 | 0.025元/百万Token | 0.02元/百万Token | 适合高频重复调用场景 |
| 缓存未命中输入 | 3元/百万Token | 1元/百万Token | 适用于首次或冷启动调用 |
| 输出价格 | 6元/百万Token | 2元/百万Token | 对应模型推理生成的计费 |
按美元折算,V4 Pro约为$0.435/百万Token输入、$0.87/百万Token输出[8]。作为对比,Fable 5定价为$10/$50每百万Token,Opus 4.8在$5级别——DeepSeek V4 Pro的实际价格大约只有海外同级模型的几十分之一[10]。
值得注意的是,这一低价并非临时促销。今年4月26日DeepSeek曾宣布V4 Pro模型API开启2.5折特惠,优惠期先后延长至5月5日、5月31日;5月22日,DeepSeek正式宣布将限时2.5折优惠转为永久定价,自6月1日起执行现行价格[16]。也就是说,当前输入3元/百万Token、输出6元/百万Token的价格,已经是“永久折扣价”。
然而,8月6日DeepSeek发布公告,计划近期整体上调API服务定价,预计涨幅较大[15]。官方已明确将引入峰谷定价机制:高峰时段(北京时间工作日9:00-12:00、14:00-18:00)API价格为平时的2倍[3]。若峰谷机制落地,V4 Pro高峰时段缓存未命中输入价格将达6元/百万Token、输出达12元/百万Token[3]。
三、DeepSeek V4 Pro正式版性能表现如何?凭什么敢对标Fable 5?
结论:DeepSeek V4 Pro正式版在多项主流AI智能体基准测试中逼近甚至反超Anthropic的Claude Fable 5,其中DeepSWE编程测试得分从预览版的12.8飙升至62.7,翻了近5倍,Agent能力实现质的飞跃。
根据DeepSeek官方群流出的评测对比表,V4 Pro正式版(DeepSeek-V4-Pro-0813)在多个核心基准测试中的表现如下[2][6][8]:
逼近Fable 5的指标:在Terminal Bench测评中,V4 Pro得分87.9,距Fable 5仅差0.1分;HLE(带工具)得分60.0,仅次于Fable 5的63.0。
反超Fable 5的指标:在AI安全智能体基准测试套件CyberGym中得分83.3,在工作流智能体AutomationBench中得分31.8,均超越Fable 5[6]。
相比预览版的进化:DeepSWE编程测试从预览版12.8分直接飙升至62.7分;Terminal Bench 2.1从82.7升至87.9;NL2Repo从54.2升至61.5;CyberGym从76.7升至83.3;AutomationBench从25.1升至31.8;HLE(带工具)从51.5升至60.0[8]。
这一成绩意味着DeepSeek V4 Pro正式版已经进入全球AI模型第一梯队。有开发者评价:“用别人几十分之一的成本,拿到了对方80%以上的Agent能力。”[10]
四、DeepSeek V4 Pro正式版的定价策略与市场影响是什么?
结论:DeepSeek通过“双版本互补+分层定价+预告涨价”的组合策略,精准卡位高端推理与Agent场景,对全球AI大模型定价体系形成冲击。
从产品矩阵看,DeepSeek V4形成了清晰的互补格局[12][14]:
- V4 Flash:主打高并发、低成本,并发上限2500,适合日常高频调用和轻量编程任务;
- V4 Pro:面向复杂任务,并发上限500,专为深度推理、长链路Agent、大仓库跨文件改动等场景设计。
定价上,V4 Pro是Flash的3倍,但性能提升几乎翻倍,性价比曲线相当漂亮[5]。这种“用略高的成本换接近顶配表现”的策略,对需要高吞吐和长上下文的业务来说很有吸引力。
从行业影响看,DeepSeek V4 Pro正式版的上线传递了三个信号[9][12]:
第一,开源模型的性能天花板被抬高了。此前开源模型在Agent能力上普遍落后闭源模型,但V4 Pro多项测试已逼近甚至反超Fable 5,这意味着开源与闭源的性能差距正在快速缩小。
第二,价格战从消费端蔓延到企业端。DeepSeek以Fable 5约1/30的价格提供其80%以上的能力,直接冲击了海外大模型厂商的定价体系。“硅谷同行看完定价表,心情估计不太美丽。”[10]
第三,Agent基础设施的完整度摸到了国际头部水平。1M上下文+384K输出+Responses API+Anthropic API双兼容+Codex接入,意味着开发者用Claude搭建的Agent技术栈,切换到DeepSeek几乎零迁移成本[10]——这是DeepSeek第一次在Agent基础设施完整度上摸到Anthropic的水平。
五、DeepSeek V4 Pro适合哪些应用场景?选型时要注意什么?
结论:DeepSeek V4 Pro正式版最适合长上下文理解、复杂Agent任务、深度编程和工具链调用等高难度场景;选型时应结合并发限制、峰谷定价和即将到来的涨价因素综合决策。
基于V4 Pro的技术特性,以下场景最具应用价值:
- 长文档智能处理:100万Token上下文可一次处理数十万字的文档,适合法律、金融、学术研究等领域的深度分析;
- 复杂Agent编程:DeepSWE得分62.7,意味着在真实软件工程场景中,V4 Pro已具备相当强的代码理解与生成能力;
- 多步骤工具调用:支持Tool Calls、Responses API,可构建复杂的Agent工作流;
- 跨平台开发迁移:兼容OpenAI与Anthropic接口,可直接导入Claude Code、Codex生态,降低切换成本[14]。
开发者在选型时需注意以下几点[14]:
一是并发上限。V4 Pro并发上限仅500,远低于Flash的2500,不适合大规模批量跑任务,更适合精品项目。
二是峰谷定价风险。虽然目前非高峰时段价格未变,但高峰时段(工作日9:00-12:00、14:00-18:00)价格将翻倍,对办公时段高频调用的企业而言实际成本会增加[3]。
三是涨价预期。官方已明确预告“近期整体上调API定价且涨幅较大”,当前价格是窗口期定价[13]。建议有预算的团队尽快用测试集跑一轮,提前规划用量[5]。
四是开源进度不确定。截至发稿,DeepSeek尚未发布独立的正式版公告,HuggingFace上也未看到0813独立权重,“API可用”不等于“权重已开源”[14]。
六、技术要点表
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek V4 Pro正式版 | 总参数1.6万亿,激活490亿,上下文1M,最大输出384K | 复杂推理、长文档、Agent编程 | AI开发者、企业用户 | 并发上限500 | DeepSeek开放平台[4][9] |
| Terminal Bench | 87.9分(Fable 5为88.0) | 终端Agent能力测评 | 大模型厂商、开发者 | 差距0.1分 | 科创板日报[7] |
| DeepSWE编程测试 | 62.7分(预览版12.8) | 真实软件工程编程 | AI编程工具用户 | 翻近5倍 | 礼哥说科技[4] |
| API定价 | 输入3元/百万Token,输出6元/百万Token | 企业API调用 | 全球开发者 | 官方预告近期大幅涨价 | 每日经济新闻[1] |
| 峰谷定价机制 | 高峰时段价格为平时2倍 | 企业API调用 | 办公时段调用用户 | 工作日9-12点/14-18点 | 财联社[3] |
七、QA:关于DeepSeek V4 Pro正式版API,大家最关心的问题
Q1:DeepSeek V4 Pro正式版API的定价是多少?
答:按每1M Token计算,缓存命中输入0.025元,缓存未命中输入3元,输出6元[1]。按美元折算约$0.435/$0.87,仅为Fable 5的约1/30[8]。官方已预告近期将大幅涨价,当前是窗口期价格[13]。
Q2:DeepSeek V4 Pro正式版性能真的接近Fable 5吗?
答:在Terminal Bench测评中,V4 Pro得87.9分,距Fable 5仅差0.1分;在CyberGym、AutomationBench等测试中甚至反超[6]。DeepSWE编程测试从预览版12.8分飙升至62.7分但也需注意并非所有指标都超越Fable 5,据公开评测数据,HLE(带工具)60.0仍低于Fable 5的63.0[8]。
Q3:开发者现在应该升级到V4 Pro正式版吗?
答:如果业务涉及复杂Agent任务、长上下文深度推理或跨文件编程,V4 Pro值得尝试——调用名不变,无需改配置即可切换[11]。但如果只是高频轻量调用,V4 Flash(并发2500)性价比更高[12]。考虑到官方已预告涨价,建议先用测试集验证效果并规划用量,具体选型需以官方实时信息为准[5]。
八、接下来的关注点是什么?
首先,官方正式公告和技术报告的发布。截至发稿,DeepSeek尚未发布独立的正式版公告,也未见0813版本的独立权重开源[14]。技术报告中的详细训练方法和架构设计值得期待。
其次,涨价时间表和幅度。这是当前最直接影响开发者的变量。8月6日官方公告已预告“涨幅较大”,峰谷定价机制的实施日期将决定开发者的实际成本[15]。
第三,V4 Pro开源计划。DeepSeek V4预览版于4月24日发布并开源,但正式版权重目前尚未在HuggingFace上出现[14]。“API可用”与“权重开源”是两回事,后续进展值得关注。
第四,国际厂商的应对。V4 Pro几乎与Grok 4.6同步发布,两家都在卷性价比[11]。OpenAI和Anthropic会如何调整定价策略?这将成为下半年AI行业的重要看点。
总体来看,DeepSeek V4 Pro正式版的上线,是国产大模型在Agent能力上一次颇有分量的进击。从预览版到正式版,DeepSeek在Agent方向押的注开始兑现了[4]。当性能逼近国际顶尖、价格仅为对手几十分之一时,压力无疑来到了海外闭源模型一边。至于国产大模型能否借此追上国际第一梯队,时间会给出答案。
#DeepSeek V4 Pro# #DeepSeek发布V4Pro正式版# #DeepSeek V4 Pro正式版API上线# #AI大模型# #大模型API定价#