对了,昨天 DeepSeek 不是发了多模态模型 DeepSeek-V4-Flash-Vision-Exp 嘛,有个细节是这个模型最大支持图片 token 数是 384 个,图片进入前会进行缩放。
那这个细节有什么用,用处就是如果你是一个很长的文本内容,其实你可以直接用图片表示,这样会更省 token,呐,就是这个意思。[笑而不语]
发布于 上海
对了,昨天 DeepSeek 不是发了多模态模型 DeepSeek-V4-Flash-Vision-Exp 嘛,有个细节是这个模型最大支持图片 token 数是 384 个,图片进入前会进行缩放。
那这个细节有什么用,用处就是如果你是一个很长的文本内容,其实你可以直接用图片表示,这样会更省 token,呐,就是这个意思。[笑而不语]