礼哥说科技
26-09-10 14:36 微博认证:科技博主

#DeepSeekV4.1Flash发布# 今天 DeepSeek 正式发布了 V4.1 Flash 模型,几个要点值得关注:

· 552B 参数 MoE 架构,采用全新的非对称结构——输入仅激活 8B,输出激活 16B,成本远低于同尺寸模型
· 原生多模态视觉理解,看图不再绕弯,直接识别
· 性能、速度、费用全面超越自家旗舰 V4 Pro,官方宣布将有序下线 V4 Pro,后续请求全部路由到 V4.1 Flash 并按 Flash 价格计费
· KV Cache 大幅压缩,相比上一代 HBM 需求降至 1/4,SSD 需求降至 1/8,Agent 场景成本显著下降
· 新定价同步生效:闲时缓存命中输入仅 0.02 元/百万 Token,继续采用峰谷定价

花更少的钱、用更强的模型,DeepSeek 这波“以下犯上”的操作确实激进。模型已开源,开发者可以直接接入。你觉得 Flash 全面替代 Pro 的时机到了吗?#AI大模型##DeepSeek##微博AI创作季#

发布于 湖北