DeepSeek V4 Pro正式版于2026年8月12日深夜静默上线,但在不到24小时内,DeepSeek官网首页横幅及开放平台公告被悄然撤下,疑似回滚,而API文档仍保留该模型参数与定价信息。这款总参数达1.6万亿的旗舰模型,定价为V4 Flash的3倍,却在第三方评测中智能指数仅比Flash高1分,引发“发错模型”或“部署失误”的广泛猜测。
8月12日深夜,DeepSeek在无发布会、无预热的情况下,将API文档中deepseek-v4-pro的版本号更新为DeepSeek-V4-Pro-0813,宣告V4 Pro正式版上线。8月13日上午,官网首页的发布新闻与开放平台公告被撤下,但API文档中模型名称与价格信息仍可查询,形成“半撤回”状态。截至8月14日,DeepSeek官方未就撤回原因发表任何声明。
V4 Pro与V4 Flash有何区别?1.6万亿参数与2840亿参数的旗舰对决
V4 Pro(0813)与V4 Flash(0731)在参数规模、定价和并发限制上存在显著差异,但实际性能感知差距远小于预期。根据DeepSeek开放平台公开信息,V4 Pro总参数达1.6万亿(MoE架构),激活参数490亿,上下文窗口保持100万token,最大输出达38.4万token;而V4 Flash总参数2840亿,激活约130亿,同样支持100万token上下文。
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek V4 Pro (0813) | 总参数1.6万亿,激活490亿,上下文1M,最大输出384K,输入3元/百万token,输出6元/百万token | 复杂推理、长上下文代码库、Agent任务 | 企业开发、AI Agent构建者、深度推理用户 | 并发限制500,需官方API调用 | DeepSeek开放平台API文档 |
| DeepSeek V4 Flash (0731) | 总参数2840亿,激活约130亿,上下文1M,输入1元/百万token,输出2元/百万token | 高频调用、成本敏感型业务、高吞吐量场景 | 中小开发者、高频API用户 | 并发限制2500,性能上限低于Pro | DeepSeek开放平台API文档 |
定价方面,V4 Pro缓存命中输入0.025元/百万token,未命中输入3元,输出6元;V4 Flash对应价格为0.02元、1元和2元。Pro输出与未命中输入价格均为Flash的3倍,缓存命中输入仅高0.005元。并发限制进一步划分定位:Flash支持2500并发,适合高吞吐量;Pro仅500并发,面向深度推理场景[10]。
为什么官网撤公告?24小时内的“半撤回”与官方沉默
DeepSeek官网于8月13日上午撤下V4 Pro发布公告,但API文档未变,构成“半撤回”状态,官方对此保持沉默。据观察者网[3]及蚁工厂[4]发布的信息,官网首页横幅涉及V4 Pro发布的内容17被移除。开发者社区中,蓝鲸新闻、微博AI等大V同步追踪了该事件[2]。
界面与API文档状态不一致引发了多种推测。事实层面,官方未发布任何撤回声明;API文档中的DeepSeek-V4-Pro-0813及定价信息仍可访问;调用名称deepseek-v4-pro未变动。推测层面,存在“部署失误”“推错模型”“配合Harness端上满血版”“故意虚晃一枪”等多重说法,均未获官方证实[5]。阑夕[5]等大V指出,部分媒体在未核实实际表现的情况下提前发布稿件,形成舆论反差。
官方跑分亮眼,第三方评测为何仅高1分?
V4 Pro在官方公布的跑分中表现惊艳,但第三方独立评测的智能指数仅比Flash高1分,形成强烈反差。这一数据冲突是回滚猜测的核心导火索。
从官方数据看,DeepSeek公布的评测显示V4 Pro在Terminal-Bench 2.1上获得87.9分,仅比Claude Fable 5低0.1分;DeepSWE得分从预览版的12.8猛增至62.7,大幅超越Claude Opus 4.8;LiveCodeBench得分93.5分登顶;Codeforces评分3206接近人类顶级程序员水平[6][7]。定价方面,折合美元后V4 Pro输入约0.435美元/百万token、输出约0.87美元/百万token,远低于Fable 5的10美元/50美元[12]。
然而,第三方评测机构Artificial Analysis公布的智能指数显示,V4 Pro仅得53分,仅比Flash(52分)高1分,与GLM-5.2持平,落后Kimi K3约7分[5]。开发者“黄鱼Veda”[12]发布的对比面板中,V4 Pro排名全球第9,与Fable 5、Opus 4.8等模型存在明显差距。开发者实测中反馈“推理早停”“思维链断裂”“复杂任务表现与Flash无明显区别”,加剧了后端部署错误的猜测[13][15]。有开发者仅使用三小时便得出“价格更贵但体验没提升”的初步结论[15]。
1.6万亿参数旗舰为何性价比感觉不足?参数不等于体验的行业启示
V4 Pro与Flash评测差距不大的原因可能是部署异常、评测基准差异或模型本身面向复杂任务的分布外泛化优化导致简单任务表现趋同。截至8月14日,尚无权威确认。需注意,Artificial Analysis的智能指数与DeepSeek公布的编程专项评测并非同一维度,二者均可作为参考,但不完全可比。
第三方评测与官方数据差距显著的原因或许在于:V4 Pro的1.6万亿总参数、490亿激活参数,在复杂编码、长上下文Agent任务中优势更明显;而Artificial Analysis智能指数这类综合评测中,简单任务占比高,两模型差距难以体现[14]。Flash先发后,基于大模型蒸馏小模型的常规研发路径,使得Pro的预期被抬高,而实际第三方体感平淡,是回滚猜测的心理背景[14]。
回滚传闻影响几何?开发者与行业如何应对?
回滚传闻对开发者实际使用影响较小,API调用名称与价格未变,但观望情绪明显。对已接入deepseek-v4-pro的开发者,模型版本更新到0813无需改动代码;但对新接入或准备升级的用户,当前版本不确定性增加,部分开发者选择暂缓生产环境迁移。有开发者认为,若最终官方确认回滚,可能是为了修复后端部署或重新评估定价策略。
行业视角看,DeepSeek目前API文档显示V4 Pro为1.6万亿参数MoE,激活490亿,支持1M上下文与384K最大输出,并集成Responses API与Anthropic API双兼容接口,可直接导入Codex使用[7][12]。这一标准化程度已接近Claude生态。若回滚属实,则说明即使是头部厂商,大模型发布也需更充分测试,避免舆论反噬。若最终官方澄清,那将成为一次“静默上线的代价”。
QA:你可能会问
Q1:DeepSeek V4 Pro明明上线了,官网为什么撤公告?
截至2026年8月14日,尚无官方确认,属“疑似回滚”状态。DeepSeek于8月12日深夜发布V4 Pro正式版(版本号0813),8月13日上午官网撤回公告,但API文档未变,官方未作回应。
Q2:V4 Pro和V4 Flash我该选哪个?价格差3倍值得吗?
取决于场景。若处理复杂编程、长代码库或Agent任务,Pro理论上更强;若高频调用且对成本敏感,Flash性价比更高。第三方评测显示两者智能指数仅差1分(53 vs 52),但Pro定价为Flash的3倍,需等待官方进一步说明后再决定。
Q3:现在还能不能用deepseek-v4-pro这个API?
可以,调用名未变。API文档中deepseek-v4-pro仍指向DeepSeek-V4-Pro-0813,输入3元/百万token、输出6元/百万token,支持1M上下文与384K最大输出。但生产环境建议关注官方后续公告。
后续关注什么?官方回应决定事件走向
DeepSeek的正式回应是判断“回滚”还是“重新发布”的关键。若确认回滚,需关注新版本号及上线时间;若为“半撤回”操作,则可能是官网信息维护问题,而非产品问题。同时需关注近期DeepSeek整体涨价预期是否影响V4价格体系[6]。行业观察人士建议开发者关注DeepSeek开放平台状态页,以官方实时信息为准。
截至发稿,DeepSeek官网首页已无V4 Pro相关横幅,但API文档信息保留。IT之家、每日经济新闻、第一财经日报等媒体均持续跟进此事[8][9][11]。无论最终结果如何,本次事件都给AI行业上了一课:在信息高度透明的开发者社区,跑分与真实体验的落差、发布与撤回的节奏,都是影响模型公信力的变量。
#DeepSeek# #DeepSeek V4 Pro# #大模型回滚# #AI行业观察# #大模型评测#