哈勃观察员
26-07-19 21:33 微博认证:科学科普博主 头条文章作者

DeepSeek V4“满血版”:最快明天发布,性能直追Opus!

全网苦等近3个月,DeepSeek V4正式版终于要来了。最早明天,最迟也就近几天,这只靴子即将落地。目前,部分用户已提前拿到灰度测试权限,分为DeepSeek V4 Flash和DeepSeek V4 Pro两个版本。民间甚至流传出一句“验货口诀”——看思维链的第一人称,如果思考过程开口是“I'm、I'll”而非老版本的“Let me”,那么恭喜你,大概率你已用上V4 GA版了。

实际上,在Fable 5与GPT-5.6 Sol持续角力的当下,开源AI圈对DeepSeek的大招期待值拉满。开发者Pankaj Kumar体验后给出中肯总结:整体表现接近Opus 4.8级别,编码能力直追GPT-5.6 Sol;Agent能力大幅增强,3D和SVG生成显著改善;但同样任务所需迭代轮数比Fable 5略多。从目前生态位看,V4大概率打不过刚发布的Kimi K3,但价格会显著更低——若性能匹配此价格,可能又是一次DeepSeek时刻。

首轮测试demo已开始外流,外界褒贬不一。有人认为已能打平Claude 5,也有开发者指出Pro版并未比Flash版领先太多。但流出的生成案例颇为惊艳:一款3D模拟射击游戏,操控攻城弩车打靶,基础UI完备;还有融合《我的世界》与《无人深空》玩法的混合游戏HTML,可玩度颇高;经典“割绳子”游戏也能一次跑出,Xbox手柄SVG测试同样过关。

真正的变数在于价格。上月底,DeepSeek向API用户发送邮件,宣布V4正式版上线后将同步调整定价,首次引入“峰谷计费”——deepseek-v4-pro百万输出tokens平时0.87美元,高峰1.74美元;deepseek-v4-flash更狠,百万输出仅0.28美元,高峰0.56美元,缓存命中输入低至0.0028美元。那个从不涨价的“价格屠夫”,第一次给算力装上了计价器。对个人用户影响不大,但对工作时间不间断跑Agent的团队,这是必须重新算的账。好在缓存命中价格极低,将批量任务、评测跑分挪到高峰之外,成本仍可压回。

对比Fable 5百万输出定价50美元,V4性价比依旧最香——毕竟性能已达Opus级。预览版发布时官方自测的SWE-bench Verified中,DeepSeek-V4-Pro-Max距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方七分之一。尽管长上下文检索、专业软件工程和部分知识推理评测中Opus仍领先,但这差距已微乎其微。
顺便提一下,deepseek-chat和deepseek-reasoner两个老模型名将于7月24日正式下线。

从目前流出的信息看,V4大概率不会是“全项第一”的模型,因为Fable 5和GPT-5.6 Sol在前,Kimi K3在侧,所以想靠纯性能掀桌子难度不小。但DeepSeek从来打的就不是这张牌。真正的看点是那条被反复验证的老路径——把Opus级的能力,价格压到七分之一。在动辄百万Token几十美元的巨头面前,即使装上了“峰谷计价器”,V4依旧是那个大杀四方的“价格屠夫”。大家等了3个月,等的正是这一刻。
#热门微博# #科技快讯# #DeepSeek V4# #哈勃观察员[超话]#

发布于 广东