#DeepSeekV4.1Flash发布# 刚刚,DeepSeek V4.1 Flash 正式上线了!这次更新有几个值得关注的点:
· 全新架构:采用 Causal-Encoder-Decoder 非对称设计,总参数 552B,输入仅激活 8B、输出激活 16B,推理成本大幅降低
· 原生多模态:终于补齐了视觉理解能力,识图、文本、推理三合一,不用再手动切换模式
· 性能反超:官方测试显示在多项基准上超越了 V4 Pro,代码和 Agent 任务表现尤其亮眼
· 缓存大瘦身:KV Cache 压缩后,HBM 需求降至 1/4,SSD 需求降至 1/8,Agent 场景调用成本更友好了
· 价格再降:Flash 系列闲时输入缓存命中低至 0.02 元/百万 Token,降幅达 60%
9 月 14 日起,V4 Pro 的 API 请求会自动路由到 V4.1 Flash,按新价格计费。网页和 App 端也已经统一接入,直接就能用。
国产大模型迭代速度越来越快了,你试过了吗?感觉怎么样?
发布于 重庆
