i歌者
26-08-02 02:02

#赛博茶馆[超话]#DeepSeek V4-Flash正式版公测,我来说点不一样的 🧠

昨天DeepSeek官宣V4-Flash正式版API开启公测,朋友圈和开发者群又炸了。作为一个每天跟大模型API打交道的人,我来说说这次更新真正值得关注的地方。

先说结论:V4-Flash正式版最核心的变化不是"更强了",而是"更便宜还变强了"。

📊 数据说话:
Agent智能体终极测试得分25.2,已经逼近Opus-4.8的25.7分,而V4-pro预览版才15.8分。这个跨越幅度相当惊人,从"勉强能用"直接跳到了"接近顶级"。

价格方面更离谱——51万tokens的本地文件阅读+全网信息检索任务,消耗0.53元。同样的任务用GPT-5.6 Sol?价格差距在数十倍到上百倍。这不是打价格战,这是在重新定义什么叫"AI基础设施应该值多少钱"。

💡 我的真实体验:
把V4-Flash接入Hermes跑了一天,最直观的感受是速度——完成同类任务大概40秒,GPT-5.6 Sol+Codex要1分47秒。当然公平地说,Codex的输出质量确实更高一些,但V4-Flash的交付已经达到了"可用水平之上"。

在skill调用准确度方面,V4-Flash正式版表现不错,能根据工具返回结果动态调整后续步骤。这说明DeepSeek在Agent能力上的投入开始见到实效。

🔥 真正值得深思的趋势:
1️⃣ 中国模型全球市场份额已达63.5%,美国模型35.5%。OpenRouter数据显示,周调用量前五名里中国模型占了四席。这不是偶然,是成本优势+能力追赶的双重效应。

2️⃣ 峰谷定价机制的引入很有意思——缓存命中的价格低到0.025元/百万tokens,但高峰时段未缓存价格反而翻倍。这意味着DeepSeek开始像运营电网一样运营算力,用户要学会"错峰调用"了。

3️⃣ DeepSeek Harness即将公布。这才是真正的重头戏。Harness是让模型从"能聊天"变成"能干活"的关键基础设施——负责上下文管理、工具调用、任务状态维护。谁的Harness生态做得好,谁就能在Agent时代占据先机。

🤔 一个观察:
现在AI竞争的焦点已经从"谁的模型更聪明"转向了"谁能更低成本地交付结果"。V4-Flash的策略很清晰:用极低的边际成本吸引开发者,用Agent能力的提升留住开发者,再用Harness生态绑定开发者。

这对OpenAI和Anthropic来说是个真正的威胁——不是因为DeepSeek的模型更强,而是因为它让"用AI"这件事的门槛低到几乎可以忽略不计。

最后抛个问题:当API成本降到趋近于零,AI的竞争壁垒到底会转向什么?是数据?是生态?还是用户体验?欢迎大家讨论 👇

#DeepSeek #AI大模型 #V4Flash #Agent智能体 #赛博茶馆

发布于 北京