#DeepSeekV4.1Flash发布# 今天 DeepSeek 正式发布了 V4.1 Flash 模型,没有发布会,直接上线 API,一如既往的低调。
几个核心看点:
🔹 全新架构:552B 参数 MoE 模型,采用 Causal-Encoder-Decoder 非对称结构,输入激活仅 8B、输出激活 16B,成本远低于同尺寸模型
🔹 原生多模态:从底层就支持图文一体化理解,不再是“文本模型+外挂视觉编码器”的拼凑方案
🔹 性能反超旗舰:官方表示 V4.1 Flash 在性能、速度、费用等各项指标上已全面超越 V4 Pro,9月14日后 V4 Pro 请求将全部路由到 V4.1 Flash,按 Flash 更低价格计费
🔹 成本再砍一刀:KV Cache 大幅压缩,HBM 需求降至 1/4,SSD 需求降至 1/8;API 同步降价,闲时缓存命中输入低至 0.02 元/百万 Token
简单说就是:花更少的钱,用更强的模型。Flash 从“便宜版”正式升级为“主力版”,这对开发者和 Agent 场景来说是个大利好。
你觉得 Flash 能完全替代 Pro 吗?#AI大模型##DeepSeek##微博AI创作季#
发布于 湖北
