搞机工程师
26-08-31 20:42 微博认证:科技博主

DeepSeek-V4-Flash-Vision-Exp上线,让我比较期待的一点是:AI正在从“文字助手”变成“视觉助手”。
以前遇到问题,我们习惯输入文字描述。
但未来很多场景其实更直接:拍一张照片,让AI帮你分析;上传一份资料,让AI帮你整理;看到一个陌生东西,直接问它是什么、怎么用。
更重要的是,这次模型不仅加入视觉能力,还保留了推理和Agent能力。
简单理解,就是AI不仅能“看见”,还可以基于看到的信息继续思考、执行任务。
距离真正的个人AI助手,也许越来越近了。
未来大家使用AI的方式,可能不再是打开一个聊天框提问,而是直接把眼前的问题交给它。
#DeepSeekV4多模态模型正式开源#

发布于 上海