DeepSeek V4 Pro正式版已在2026年8月12日晚间低调上线,与主打高性价比的V4 Flash不同,Pro版本定位于复杂Agent任务和深度推理,价格是Flash的三倍,但性能直逼国际顶尖闭源模型。

  

  一、性能与架构差异:Pro定位“旗舰级Agent引擎”

  模型规模:V4 Pro采用MoE架构,总参数1.6万亿,每次推理激活490亿参数;V4 Flash总参数284B,激活13B,Pro的知识容量远大于Flash。

  Agent能力跃升:V4 Pro正式版(0813)在DeepSWE软件工程基准上从预览版的12.8飙升至62.7,提升近5倍;Terminal Bench 2.1得分87.9,逼近榜首的88.0;CyberGym得分83.3,反超Fable 5的83.1。Flash虽经后训练大幅增强,但其能力上限仍低于Pro。

  上下文能力:两者均支持100万Token上下文,但Pro最大输出达38.4万Token,高于Flash,更适合处理超长代码库和多步代理任务。

  

  二、价格与并发差异:Flash跑量,Pro攻坚

  基础定价:V4 Pro输入3元/百万Token,输出6元/百万Token,均为Flash(输入1元、输出2元)的3倍;缓存命中时Pro仅0.025元/百万Token,Flash为0.02元/百万Token。

  并发与场景:Flash支持2500个并发请求,主打高频、高吞吐量场景;Pro并发上限为500,将算力集中于高难度推理任务。

  成本对比海外:Pro折合约0.435美元/百万Token输入,远低于Anthropic Fable 5的10美元级别,性价比优势明显。

  三、使用场景建议:按需选型,避免“杀鸡用牛刀”

  Flash首选场景:日常聊天、轻量编程、高频调用和批量数据处理。Flash的0731正式版Agent能力已超过Pro预览版,对多数任务“够用且更省钱”。

  Pro适用场景:大代码库跨文件修改、长链路Coding Agent、复杂文档推理及深度研究任务,才值得为Pro的三倍单价买单。

  双版本互补:Flash负责“更便宜、更高速”,Pro负责“能力上限”,两者共同构成V4系列完整产品矩阵,而非内部竞争关系。