DeepSeek V4.1 Flash正式发布,有几个细节值得关注:
首先,它开始支持原生多模态视觉理解,意味着图像不再只是外挂能力,而是进入模型本身的能力体系。
其次,这次不是简单堆参数,而是对模型结构进行了重新设计,目标非常明确:在提升能力上限的同时,把推理速度和吞吐继续往上推。
此外,这套架构并没有只盯着当前规模,而是考虑了向更大参数模型扩展。
这透露出DeepSeek对Flash系列的思路:不是单纯做一个“小而快”的模型,而是在探索一套“兼顾智能、多模态、速度和规模化部署”的新架构。
#DeepSeekV4.1Flash发布#
发布于 上海
