谯华
26-09-10 15:13 微博认证:科技博主 微博原创视频博主

#DeepSeekV4.1Flash发布# 刚刚,DeepSeek V4.1 Flash 正式上线了!这次更新有几个值得关注的点:

· 全新架构:采用 Causal-Encoder-Decoder 非对称设计,总参数 552B,输入仅激活 8B、输出激活 16B,推理成本大幅降低

· 原生多模态:终于补齐了视觉理解能力,识图、文本、推理三合一,不用再手动切换模式

· 性能反超:官方测试显示在多项基准上超越了 V4 Pro,代码和 Agent 任务表现尤其亮眼

· 缓存大瘦身:KV Cache 压缩后,HBM 需求降至 1/4,SSD 需求降至 1/8,Agent 场景调用成本更友好了

· 价格再降:Flash 系列闲时输入缓存命中低至 0.02 元/百万 Token,降幅达 60%

9 月 14 日起,V4 Pro 的 API 请求会自动路由到 V4.1 Flash,按新价格计费。网页和 App 端也已经统一接入,直接就能用。

国产大模型迭代速度越来越快了,你试过了吗?感觉怎么样?

发布于 重庆