德里克文
26-08-31 20:51 微博认证:AINEXT 联合创始人 AI博主

#DeepSeekV4多模态模型正式开源#

刚刚,DeepSeek V4系列首个多模态模型正式开源!

🔥 DeepSeek-V4-Flash-Vision-Exp
· 8月21日上线API,今日MIT协议开源至Hugging Face
· V4系列首款原生支持图片输入的视觉模型
· 100万上下文窗口,支持JPEG/PNG/GIF/WebP

几个硬核亮点:

✅ 多模态Agent能力接近Opus-4.8
在ZeroBench视觉推理和Agents' Last Exam综合测试中登顶榜首,真实世界软件工程测试DeepSWE以59.3%反超Opus-4.8成为第一

✅ 纯文本能力完整保留
7项纯文本Agent任务中5胜1平1负,与V4-Flash正式版持平

✅ 迭代速度惊人
7月31日Flash正式版→8月13日Pro正式版→8月21日视觉实验版→8月31日开源,一个月完成多轮更新

✅ 价格不变
API资费与普通V4-Flash保持一致,缓存命中低至0.05元/百万Token

开源内容包括模型文件、Tokenizer、Prompt Encoding参考实现,以及最小化PyTorch推理实现,覆盖视觉编码器、Aligner、DFlash Attention、MoE、Hyper-Connections与DSpark等核心模块。

从文本到视觉,DeepSeek正在补齐Agent体系的感知输入环节。国产大模型的开源节奏,越来越快了。

#DeepSeek##AI开源##多模态大模型##微博AI创作季#

发布于 福建