测试了一下DeepSeek V4.1 Flash:
更强、更快、更普惠
今天,我们正式发布 DeepSeek V4.1 Flash 模型,具备原生多模态视觉理解能力,能力更强,速度更快,价格更优惠。
- 552B 参数,采用全新的 Causal-Encoder-Decoder 结构,输入激活仅 8B,输出激活 16B,成本显著低于已知的同尺寸模型。
- 大幅减少了 KV Cache 缓存的大小,每 token 仅缓存 890 bytes。
- 采用新的预训练方式,以及更大规模的强化学习后训练。在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。
当前,官方 APP 与网页端原有的三个对话模式(快速、专家、识图)已合并,后续将统一由 V4.1 Flash 模型提供服务。
DeepSeek 官方 API 价格整体下调。最新定价及峰谷时段详细信息请见价格海报。
#DeepSeekV4.1Flash发布# http://t.cn/AX0gZUSj
发布于 江苏
