Sandy絮児
26-08-21 20:36 微博认证:北京新片场传媒股份有限公司 编辑 时尚博主 超话主持人(絮儿的小基地超话) 微博原创视频博主

#DeepSeekV4视觉模型上线# 今天下午,DeepSeek毫无预警地给V4系列安上了“眼睛”。全新多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp正式上线API平台,虽然名字里还带着“Exp”的实验标签。

有意思的是时间点——就在昨天,DeepSeek Harness刚发布v0.1.0-rc.8版本,提前打通了多模态输入支持。过去一周GitHub讨论区里,“怎么让DeepSeek看图”成了高频问题。因为V4之前不支持图片输入,开发者只能自己在前面接个视觉模型做“图像转文字”的桥接。这下好了,官方直接把视觉能力原生塞进了模型里。

性能上,纯文本能力跟V4-Flash持平,但多模态Agent能力直接逼近了Opus-4.8。支持1M上下文、最大输出384K token。价格延续了DeepSeek一贯的路线,图片按尺寸折算token计费,单张最高384 tokens,跟Flash同价。Files API也同步上线了,图片上传一次就能反复调用。

从纯文本到能看图、能处理混合文档,V4系列这块视觉拼图算是正式补齐了。感兴趣的开发者可以直接调API,模型名:deepseek-v4-flash-vision-exp。 #一分钟精选视频扶持计划# http://t.cn/AXptuoJN

发布于 上海