DeepSeek V4 Pro正式版API上线:3元/百万Token输入逼近Fable 5,现在升级值得买吗?

2026-08-13 09:09 来源:数码趋势发掘录

  北京时间8月13日凌晨,DeepSeek V4 Pro正式版API上线,模型版本切换为DeepSeek-V4-Pro-0813,调用名保持不变。新版支持100万Token上下文和38.4万Token最大输出,定价输入3元/百万Token、输出6元/百万Token,多项Agent测试逼近甚至反超Claude Fable 5,官方预警近期将大幅涨价。

  这次更新并非大张旗鼓,而是“API先动、官宣在路上”。8月12日深夜,DeepSeek开放平台更新了API文档,将V4 Pro从预览版转为正式版。截至发稿,官方尚未发布完整技术报告,但API已可调用,按DeepSeek一贯的产品节奏,正式公告预计很快落地。[1]

  从产品线看,DeepSeek V4系列已形成清晰的双轨格局:Flash主打高频、低成本、高并发,Pro主打高难度推理与复杂Agent任务。7月31日V4 Flash正式版刚上线公测,8月6日DeepSeek便预告“近期整体上调API定价”,如今V4 Pro正式版落地,价格与配置也印证了业内人士此前的推测。[2]

  DeepSeek V4 Pro正式版值得升级吗?先看价格和配置

  结论:如果你已经在使用V4 Pro预览版,或正为复杂代码仓库、多步Agent任务寻找更强引擎,正式版值得立即升级——因为调用名没变,成本不变,能力却大幅提升;如果只是日常问答、轻量调用,V4 Flash可能更划算。

  先看价格。DeepSeek V4 Pro正式版定价为:缓存命中输入0.025元/百万Token,缓存未命中输入3元/百万Token,输出6元/百万Token。相比之下,V4 Flash对应价格分别为0.02元、1元、2元。Pro在输入和输出上的成本约为Flash的3倍。[3]

  再看配置。V4 Pro总参数1.6万亿、激活490亿,原生支持100万Token上下文和38.4万Token最大输出,并支持思考与非思考双模式。在底层架构上,服务同时提供OpenAI和Anthropic兼容接口,已在使用任一标准的团队无需重新配置技术栈即可切换。[6]

产品/型号价格/定位核心配置优势短板适合谁注意点
DeepSeek V4 Pro正式版(0813)缓存命中输入0.025元/百万Token,缓存未命中输入3元/百万Token,输出6元/百万Token;定位旗舰高难推理1.6T总参数/490B激活,1M上下文,384K最大输出,思考+非思考双模式,兼容Responses API+Anthropic API,支持Tool Calls、结构化JSON输出、FIM补全(非思考模式)Agent能力大幅增强,DeepSWE从12.8分升至62.7分;Terminal Bench 2.1达87.9分,逼近Fable 5;CyberGym和AutomationBench反超Fable 5;价格约为海外同级模型的几十分之一并发上限仅500,低于Flash的2500;官方预警近期将整体涨价;对轻量调用性价比不高复杂代码生成、长上下文分析、多步Agent工作流、需要接入Codex或Claude技术栈的开发者涨价前可评估用量;需关注并发限制是否符合业务规模
DeepSeek V4 Flash正式版(0731)缓存命中输入0.02元/百万Token,缓存未命中输入1元/百万Token,输出2元/百万Token;定位高频低延迟与V4同架构,支持1M上下文,Agent能力较预览版增强,但不具备Pro的完整高难推理能力价格低、并发高达2500,适合大规模调用和成本敏感场景在DeepSWE、Terminal Bench等复杂Agent测试上落后Pro较多高频调用、批量处理、成本敏感型业务官方涨价计划可能同样影响Flash,需提前规划成本

  DeepSeek V4 Pro性能提升有多大?为什么说“逼近甚至反超Fable 5”?

  结论:V4 Pro正式版的Agent能力不是小修小补,而是跨了一个大台阶。在多个权威基准上,它已经摸到甚至超过了闭源第一梯队的门槛。

  据科创板日报援引的基准测试数据,V4 Pro正式版在终端Agent测试Terminal Bench 2.1上得分87.9分,逼近Anthropic Claude Fable 5的88.0分;在AI安全智能体测试CyberGym上得分83.3分,反超Fable 5;在高难度智能体测试AutomationBench上得分31.8分,同样超过Fable 5。[5]

  最受关注的编程Agent基准DeepSWE中,V4 Pro正式版从预览版的12.8分直接飙升至62.7分,增长近4倍;NL2Repo从38.5分提升至61.5分;DSBench-Hard分数翻了一倍多。[4]这种提升说明,正式版并非简单的参数微调,而是针对Agent执行精度、工具调用链路和长上下文理解做了系统性优化。

  从技术路线看,V4 Pro总参数1.6万亿、激活490亿,但核心突破在于“后训练迭代”和Agent基础设施的完整度。它与Responses API和Anthropic API的兼容,让原本跑在Claude技术栈上的Agent可以零成本迁移,相当于直接给开发者发了一张“无缝切换”的通行证。[7]

  横向对比海外模型,V4 Pro价格为约0.435美元/百万Token输入(折合人民币3元),输出约0.87美元(6元),而Claude Fable 5定价为10美元/50美元每百万Token,Opus 4.8在5美元级别。DeepSeek用别人几十分之一的成本,拿到了对方80%以上的Agent能力,这也在舆论场引发“闭源压力山大”的讨论。

  DeepSeek V4 Pro和V4 Flash怎么选?买前必看

  结论:无脑选Pro不可取,按需分配才是正解。

  DeepSeek已经通过定价和并发限制明确划分了产品层级:Flash并发上限2500,Pro仅500。官方把容量集中到高难度推理、长上下文编码和Agent工作流,而不是拼吞吐。如果你的业务是海量短请求、对延迟和成本敏感,Flash是更合理的选择;如果任务复杂,需要长上下文、工具调用、代码生成,Pro才值得掏三倍价格。

  从实际应用场景看,以下情况更适合Pro:

  • 单次调用需要处理超过20万Token的长文档或大型代码仓库;
  • 需要多步骤Agent执行,例如自主编程、自动化运维、复杂信息检索;
  • 已使用Claude或OpenAI技术栈,希望以更低成本迁移并保持兼容;
  • 对输出质量敏感,需要384K超长输出支持。

  而Flash更适合:高频客服、批量文本分类、简单摘要、低延迟交互式应用。Flash的成本和并发优势能有效控制账单,但复杂推理能力有限。需要提醒的是,官方已在定价页标注“计划近期整体上调API服务定价,预计涨幅较大”。[3]重度用户建议提前评估用量,在涨价前锁定成本。

  从产品迭代节奏看,DeepSeek这套“模型名不变、能力大变”的后训练打法已经成熟。7月31日Flash正式版重训后Agent能力超过预览版Pro,8月13日Pro正式版又把短板补齐。这种高频次升级对开发者是好事,但也要求团队保持跟进,及时测试新版本带来的效果变化。

  为什么DeepSeek突然涨价?背后有哪些考量?

  结论:涨价大概率是因为V4 Pro正式版带来更高的推理算力消耗,官方用价格杠杆区分产品层级,同时也标志着行业竞争从“价格战”转向“能力战”。

  8月6日,DeepSeek发布公告称“计划近期整体上调API服务定价,预计涨幅较大,请合理安排您的使用”,当时就有业内人士预测V4 Pro正式版即将上线。[2]如今V4 Pro价格尘埃落定:输入输出均为Flash的3倍,这并非简单涨价,而是把不同能力标出了不同价格。

“此次官宣涨价也意味着DeepSeek即将上线V4-Pro正式版,将对整体算力调用产生影响。”——业内人士分析

  从行业背景看,国内大模型API价格已经打到“白菜价”,但Agent能力的军备竞赛才刚刚开始。DeepSeek选择在V4 Pro正式版上提高定价,既是对自身推理成本的现实考量,也是对产品层级的一次重新定义——Flash走量、Pro攻坚,两条腿走路。西部计算机研报也指出,衡量大模型产品的标准是在有限算力成本下产生更高效的推理与Agent执行效果,潜在企业级AI服务市场空间巨大。[7]

  需要强调的是,“大幅涨价”目前只是官方预告,具体方案尚未公布,实际涨幅需以官方实时信息为准。[1]如果你正在开发Agent应用,建议关注两个时间节点:一是官方正式涨价公告,二是V4 Pro后续可能的技术报告,两者都可能影响你的技术选型和成本规划。

  DeepSeek V4 Pro常见问题解答

  DeepSeek V4 Pro兼容OpenAI和Anthropic接口吗?

  兼容。V4 Pro正式版原生支持OpenAI的Responses API格式,同时兼容Anthropic API格式,开发者可直接导入Codex使用。已在任一标准上的团队无需重新配置技术栈即可切换,切换成本几乎为零。[6]

  DeepSeek V4 Pro多少钱?和Flash比贵多少?

  按每百万Token计算,V4 Pro缓存未命中输入3元、输出6元,缓存命中输入0.025元;V4 Flash分别为1元、2元和0.02元。Pro的输入输出价格是Flash的3倍,但性能尤其是Agent能力大幅领先,适合复杂任务场景。

  现在升级V4 Pro需要改代码吗?

  不需要。模型调用名称保持“deepseek-v4-pro”不变,官方已将模型版本切换为DeepSeek-V4-Pro-0813,老接口直接升级即可调用新模型,开发者无需修改代码。[1]

  最后,无论你是开发者还是AI产品经理,都建议密切关注DeepSeek官方后续公告,尤其是涨价时间表。在能力与成本之间,选择最适合自己业务的“配置”,才是理性决策。

  #DeepSeek V4 Pro正式版# #DeepSeek涨价# #AI模型API# #Agent能力# #大模型选购#