8月12日深夜,国产大模型DeepSeek V4 Pro正式版悄悄上线,版本号更新为DeepSeek-V4-Pro-0813,输入价格仅3元/百万token,多项Agent基准测试逼近甚至超越Anthropic Fable5,官方同时预告近期将大幅涨价。[1]
这次更新没有发布会,没有预告,只有官网API文档的一行版本变更:deepseek-v4-pro对应的模型版本从preview切换到了正式版。调用名保持不变,开发者无需修改代码即可直接升级。上线时间点也颇为微妙,几乎与马斯克旗下SpaceXAI发布Grok 4.6同步。[2]
DeepSeek V4 Pro正式版现在值得升级吗?价格和配置有什么变化?
结论:对于正在使用DeepSeek V4 Pro预览版或V4 Flash的开发者,如果业务涉及复杂推理、长上下文或Agent应用,现在升级完全值得,尤其官方已经预告涨价,当前是性价比最高的窗口期。
首先看价格。DeepSeek V4 Pro正式版定价为:输入3元/百万token,输出6元/百万token,缓存命中输入仅0.025元/百万token。作为对比,V4 Flash的价格分别为输入1元、输出2元、缓存命中0.02元,Pro正好是Flash的3倍。[1]
这个价格放到国际市场上是什么水平?Anthropic Fable5的定价为10美元/百万token输入、50美元/百万token输出;Claude Opus 4.8为5美元级别。按当前汇率折算,DeepSeek V4 Pro的输入价格约为0.435美元、输出约0.87美元,仅为海外同级模型的几十分之一。[3]
配置方面,DeepSeek V4 Pro正式版延续了预览版的规格:总参数1.6万亿(据公开报道[2])、激活参数490亿,支持100万token上下文窗口,最大输出长度达38.4万token。同时原生支持“思考”和“非思考”双模式切换,开发者可以根据任务复杂度自由选择低延迟秒回或深度推理。这一设计在实际使用中非常实用:写邮件、做摘要关掉思考模式,代码调试、复杂逻辑推演则开启思考模式。[4]
生态兼容性也是此次升级的重点。V4 Pro正式版原生支持Tool Calls、Responses API,并兼容Anthropic API格式,可以直接导入Codex使用。这意味着之前基于Claude构建的Agent技术栈,切换到DeepSeek几乎无需改动代码。[5]
| 产品/型号 | 价格/定位 | 核心配置 | 优势 | 短板 | 适合谁 | 注意点 |
|---|---|---|---|---|---|---|
| DeepSeek V4 Pro正式版 | 输入3元/百万token,输出6元,缓存命中0.025元;旗舰级Agent模型 | 1.6万亿总参数(据公开报道),激活490亿,100万上下文,38.4万最大输出,思考/非思考双模式 | Agent能力暴涨,多项测试逼近/超越Fable5;价格仅为海外零头;兼容Anthropic API,迁移成本极低 | 并发上限500,低于Flash的2500;官方预告近期大幅涨价;思考模式可能带来更高延迟 | 复杂推理、长文档处理、Agent开发、编程助手 | 官方预告涨价,需抓住当前低价窗口;1.6万亿参数未经官方技术报告证实 |
| DeepSeek V4 Flash正式版 | 输入1元/百万token,输出2元,缓存命中0.02元;高并发性价比之选 | 支持100万上下文,384K最大输出,双模式(2026年7月正式版上线) | 价格极低,并发上限2500,适合高频调用 | 复杂任务能力弱于Pro,Agent基准分数较低 | 高频API调用、实时聊天、分类摘要、简单生成 | 如需要更强Agent能力,升级Pro更划算 |
| Anthropic Fable5 | 输入10美元/百万token,输出50美元/百万token(约70/350元人民币) | 面向Agent的闭源前沿模型,上下文约200K(据公开资料) | 综合能力最强,在TerminalBench等少数测试中仍领先 | 价格昂贵,国内访问不便,不支持中文优化 | 追求极致性能且预算充足的企业 | 价格是DeepSeek V4 Pro的数十倍,但性能差距已缩小至几个百分点 |
DeepSeek V4 Pro性能到底有多强?比预览版和Fable5强在哪?
结论:根据多家媒体转载的DeepSeek官方群评测对比表,V4 Pro正式版在多个Agent基准测试中大幅超越预览版,部分项目甚至反超Anthropic Fable5。
最震撼的是DeepSWE得分。这是一个针对长周期、高复杂度真实软件工程的编程智能体测试,V4 Pro预览版得分仅12.8,正式版直接飙升至62.7,翻了将近5倍。[3]这说明DeepSeek在Agent能力上的“后训练迭代”已经产生了质变,同一个模型名,preview和正式版差距大到不像一个物种。
再看终端Agent测试Terminal Bench 2.1:V4 Pro正式版得分87.9,逼近Fable5的88.0,也超过了Opus-4.8的85.0;在AI安全智能体评测基准CyberGym上,V4 Pro从52.7升至83.3,反超了Fable5;在高难度工作流智能体AutomationBench上,V4 Pro得分31.8,同样领先。[2]
即使在绝对优势项目上,V4 Pro也在缩小差距:HLE带工具测试得分60.0,仅次于Fable5的63.0;NL2Repo得分61.5,仅次于Opus-4.8的69.7。[3]这些数据共同指向一个事实:国产模型在前沿Agent能力上已经摸到了第一梯队的裤脚。
值得注意的是,这些成绩并非来自官方技术报告,而是DeepSeek官方群流出的评测表,被华尔街见闻、科创板日报、IT之家等多家媒体转载报道。[2][3][4]截至发稿,DeepSeek尚未发布正式的技术报告长文,但API已经先行更新,这是DeepSeek一贯的节奏。
为什么说DeepSeek V4 Pro是“大招”?竞争格局有何变化?
结论:V4 Pro正式版用别人几十分之一的成本拿到了对方80%以上的Agent能力,同时兼容Anthropic API,标志着国产模型从“参数竞赛”正式转向“实用生态”竞争。
这次更新的特殊之处在于,它几乎与马斯克旗下SpaceXAI的Grok 4.6同日发布。两款模型都主打高性价比和Agent能力,同一天冲击前沿模型第一梯队。[2]这种“撞车”并非巧合,而是行业竞争白热化的缩影:上一轮拼参数、拼上下文,这一轮已经开始拼Agent落地能力。
DeepSeek的战略布局非常清晰:V4系列分为Flash和Pro两条产品线。Flash面向高并发、低成本场景,适合高频调用;Pro则集中资源攻坚复杂推理、长上下文编码和Agent工作流,并发上限设置得比Flash低(500 vs 2500),引导开发者将Pro用于“重活”而非“跑量”。[6]
更深层的信号是API兼容。V4 Pro正式版原生支持Responses API和Anthropic API格式,可以直接导入Codex。这意味着,Anthropic生态的开发者迁移到DeepSeek几乎零成本。有开发者算了一笔账:用DeepSeek V4 Pro的成本只有Claude Opus的1/60。[2]硅谷同行看完定价表,心情大概不会太美丽。
从行业视角看,这次升级印证了国产大模型从“能用”到“好用”的关键转折。过去国产模型常被诟病“跑分好看、实战拉胯”,而V4 Pro在真实编程智能体测试DeepSWE上的近5倍提升,说明模型在复杂任务执行和工具调用能力上取得了实质性突破。这比单纯的参数堆砌更有意义。
官方预告大幅涨价,现在是抄底窗口吗?
结论:是。DeepSeek官网价格页已明确标注“计划近期上调整体价格,预计涨幅较大”,当前价格大概率是V4 Pro正式版的最后一次低价。
官方在API价格页面备注了涨价预告,尽管没有给出具体时间和幅度,但“涨幅较大”四个字已经足够让开发者紧张。从市场逻辑看,V4 Pro正式版的定价(3元/百万token输入、6元/百万token输出)虽然高于V4 Flash,但相对海外竞品仍属“白菜价”。在性能逼近第一梯队的背景下,这种低价策略显然不可持续。
对于个人开发者和中小企业,现在接入API相当于锁定当前成本。即使涨价后,DeepSeek的直接计费可能仍低于海外模型,但涨幅若超过50%,预算敏感型项目就会感受到压力。建议将当前价格视为基准,提前评估业务可承受的涨幅上限。
需要提醒的是,涨价预告并不意味着立即执行。参考历史,DeepSeek V4 Flash正式版上线时也调整过价格,但幅度不大。此次特意强调“涨幅较大”,或许是在为新版本的定价做铺垫。无论涨多少,在涨价真正生效前,现有API调用都会按原价计费。所以,想要“薅羊毛”的开发者不妨趁现在多跑一些测试,甚至提前储备一些Token。
开发者和普通用户怎么选?V4 Pro、V4 Flash、Fable5对比
结论:如果没有强烈的前沿性能刚需,V4 Flash仍是最具性价比的日常选择;如果涉及Agent开发、长文档深度分析或复杂编程,V4 Pro正式版是目前国产模型中的最优解;预算无上限且对海外生态依赖强的团队可继续使用Fable5。
普通用户通过API调用AI的频率较低,对价格不敏感,但对响应速度和稳定性要求高。这种情况下,V4 Flash(2500并发)比V4 Pro(500并发)更有优势,毕竟Flash的输入价格只有1元/百万token,输出2元。即便是复杂任务,Flash也能通过后训练迭代处理大部分场景。
开发者则需要根据业务类型判断:如果你的应用涉及多步骤工具调用、代码生成与执行、长上下文推理(比如50万字以上文档),V4 Pro正式版的高输出上限(38.4万token)几乎是不可替代的优势。加上Anthropic API兼容,从Claude切换过来的学习成本极低。
与Fable5相比,V4 Pro在CyberGym和AutomationBench上已经反超,但TerminalBench仍有0.1分差距,HLE和NL2Repo也略有落后。如果项目对某几项测试指标有硬性要求,建议用真实业务数据做A/B测试,而不是只看总分。
需要特别指出的是,V4 Pro正式版默认开启思考模式,这会增加响应延迟。对于实时交互场景,可以使用非思考模式端点,但在复杂任务中可能会降低准确率。开发者应根据具体任务灵活切换,而不是一味追求快或准。
媒体和网友如何评价这次更新?
爱范儿等科技媒体关注到DeepSeek“深夜突袭”的发布节奏,指出V4 Pro正式版的能力进阶与价格优势形成了强烈反差;科技博主“礼哥说科技”列出了1.6万亿参数、激活490亿等细节,称“Agent能力暴涨”;“Ai嗒嗒”则强调“开源直接逼近甚至反超闭源第一梯队”。[5]
华尔街见闻报道称,这次更新“几乎与Grok 4.6同步”,两款高性价比模型同时冲击前沿模型第一梯队,AI大模型价格与性能竞争再度升温。[2]科创板日报引述开发者观点,认为“用DeepSeek V4 Pro的成本只有Claude Opus的1/60”。[3]
也有部分网友持谨慎态度,认为评测数据来自官方群流出,可能存在“自卖自夸”成分;正式技术报告尚未发布,真正的实力需要第三方独立测试验证。对此,我们建议以官方后续发布的技术报告和社区实测为准。
QA:关于DeepSeek V4 Pro,大家最关心的几个问题
Q1:DeepSeek V4 Pro正式版的价格到底是多少?
官网API文档显示,缓存未命中输入3元/百万token,输出6元/百万token,缓存命中输入0.025元/百万token,均为V4 Flash的3倍。官方已预告近期将大幅涨价,当前是最后的低价窗口。[1]
Q2:DeepSeek V4 Pro比预览版强了多少?
根据流出的评测数据,DeepSWE编程智能体得分从12.8飙升至62.7,翻了近5倍;Terminal Bench从72.1升至87.9,逼近Fable5的88.0;CyberGym从52.7升至83.3,反超Fable5。[2][3]这些数据未经官方技术报告确认,但已获多家媒体转载。
Q3:V4 Pro和Anthropic Fable5怎么选?
V4 Pro输入价格约为Fable5的1/24(按汇率折算),性能在多个Agent基准上互有胜负。如果成本敏感或需要100万token超长上下文,V4 Pro是明确选择;如果追求极致标杆性能且预算充足,Fable5仍值得考虑。建议根据实际业务场景做对比测试。
总体而言,DeepSeek V4 Pro正式版是2026年下半年国产AI大模型最重磅的更新之一。它用极致的性价比和近乎完整的生态兼容性,将Agent开发的门槛拉低了一个量级。接下来,就看官方何时兑现“涨价预告”,以及Grok 4.6等竞品会如何回应。在此之前,开发者不妨抓紧时间,把想测的场景都测一遍。
#DeepSeekV4Pro正式版# #DeepSeek涨价# #AI大模型# #Agent智能体# #国产大模型#