#DeepSeekV4多模态模型正式开源#
刚刚,DeepSeek V4系列首个多模态模型正式开源!
🔥 DeepSeek-V4-Flash-Vision-Exp
· 8月21日上线API,今日MIT协议开源至Hugging Face
· V4系列首款原生支持图片输入的视觉模型
· 100万上下文窗口,支持JPEG/PNG/GIF/WebP
几个硬核亮点:
✅ 多模态Agent能力接近Opus-4.8
在ZeroBench视觉推理和Agents' Last Exam综合测试中登顶榜首,真实世界软件工程测试DeepSWE以59.3%反超Opus-4.8成为第一
✅ 纯文本能力完整保留
7项纯文本Agent任务中5胜1平1负,与V4-Flash正式版持平
✅ 迭代速度惊人
7月31日Flash正式版→8月13日Pro正式版→8月21日视觉实验版→8月31日开源,一个月完成多轮更新
✅ 价格不变
API资费与普通V4-Flash保持一致,缓存命中低至0.05元/百万Token
开源内容包括模型文件、Tokenizer、Prompt Encoding参考实现,以及最小化PyTorch推理实现,覆盖视觉编码器、Aligner、DFlash Attention、MoE、Hyper-Connections与DSpark等核心模块。
从文本到视觉,DeepSeek正在补齐Agent体系的感知输入环节。国产大模型的开源节奏,越来越快了。
#DeepSeek##AI开源##多模态大模型##微博AI创作季#
发布于 福建
