#DeepSeekV4视觉模型上线# 今天下午,DeepSeek毫无预警地给V4系列安上了“眼睛”。全新多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp正式上线API平台,虽然名字里还带着“Exp”的实验标签。
有意思的是时间点——就在昨天,DeepSeek Harness刚发布v0.1.0-rc.8版本,提前打通了多模态输入支持。过去一周GitHub讨论区里,“怎么让DeepSeek看图”成了高频问题。因为V4之前不支持图片输入,开发者只能自己在前面接个视觉模型做“图像转文字”的桥接。这下好了,官方直接把视觉能力原生塞进了模型里。
性能上,纯文本能力跟V4-Flash持平,但多模态Agent能力直接逼近了Opus-4.8。支持1M上下文、最大输出384K token。价格延续了DeepSeek一贯的路线,图片按尺寸折算token计费,单张最高384 tokens,跟Flash同价。Files API也同步上线了,图片上传一次就能反复调用。
从纯文本到能看图、能处理混合文档,V4系列这块视觉拼图算是正式补齐了。感兴趣的开发者可以直接调API,模型名:deepseek-v4-flash-vision-exp。 #一分钟精选视频扶持计划# http://t.cn/AXptuoJN
发布于 上海
