【#DeepSeekV4.1Flash发布#】
DeepSeekV4.1Flash模型正式发布,支持原生多模态视觉理解,新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。
V4.1 Flash为552B参数的MoE模型,输入激活仅8B、输出激活16B,成本显著低于已知同尺寸模型。采用创新的causal-encoder-decoder结构,输入输出不对称设计;配合新预训练方式与更大规模强化学习后训练,基准测试智能水平超越V4 Pro等旗舰模型。KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。
自9月10日12时起Flash系列调价,空闲时段输入缓存命中降至0.02元/百万Token、未命中1元、输出4元,其中缓存命中输入价格降幅高达60%。延续峰谷分时计价,高峰时段(周一至周五9:00-12:00、14:00-18:00)价格为空闲时段两倍。
