DeepSeek V4.1 Flash 今天正式发布,进步很大:
- 新架构与原生视觉
采用全新的 Causal Encoder-Decoder 架构,552B 主干参数,输入阶段激活 8B、输出阶段激活 16B。原生支持图片和文字理解,支持百万 token 上下文。
- Agent 能力明显提升
官方测试中,Terminal-Bench 2.1 从上一代 V4 Flash 的 82.7 提升到 90.6,DeepSWE v1.1 从 54.4 提升到 74.2。多项 Agent 测试进入旗舰水平,但并非所有项目都领先,实际表现也与执行框架有关。
- 缓存更省,API 更便宜
KV Cache 对 HBM、SSD 的需求分别降至上一代约 1/4、1/8。闲时每百万 token:缓存命中输入 0.02 元、未命中输入 1 元、输出 4 元,高峰价格翻倍。
高峰为北京时间工作日 9:00—12:00、14:00—18:00,其余为闲时。
- Harness 与合作生态同步更新
DeepSeek Harness 0.1.5 与新模型联合优化,支持不破坏缓存的动态系统提示词更新,改善文件上传、HTML/PDF 预览、子代理协作和长会话体验,并提供实验性 Agent Teams。
腾讯 WorkBuddy、CodeBuddy 和 OpenCode 已作为官方合作伙伴全量接入 V4.1 Flash。API 正式模型名为 deepseek-flash;9 月 14 日中午 12 点起,旧 V4 Pro 请求也将转到 V4.1 Flash,按 Flash 价格计费,直到未来 V4.1 Pro 上线。
#DeepSeekV4.1Flash发布#
发布于 安徽
