酋知鱼
26-09-09 16:33 微博认证:微博新知博主 汽车博主

#DeepSeekV4.1Flash中间版本内测#

DeepSeek 这次没开发布会。9/8 官方群里一个公告,V4.1 Flash 中间版本开测,连接口名都自带保质期。

1. 名字写着档期:调用名 deepseek-v4.1-flash-expires-on-0910,9/10 自动过期下线,体验窗口就两天。单账号限流 20 并发,对比正式版 V4 Flash 的 2500——这是拿来测功能的,不是拿来扛流量的。

2. 换了骨架:V4.1 Flash 采用全新模型结构,多模态做成原生支持。之前 V4 Flash 想看图,得单独挂 Vision-Exp 实验包(8/21 才上线、8/31 刚开源权重),现在图文输入输出一个模型搞定,不用切模型。迁移成本为零,base_url 不变,改个名就能调。

3. 速度是开发者的第一感受。同一套任务端到端,SVG 代码生成快 6 倍、长上下文检索快 5 倍多,X 上有人跑到最高 507 token/s。一位 AI 应用 CEO 拿 6 个业务场景做了对照:V4.1 总耗时 1 分 55 秒,V4 Flash 跑了 12 分 10 秒,思考量省七成多。最拉开差距的是听话测试——让它推荐口语练习工具,V4.1 点名「英语流利说、多邻国、Cambly」三款真实产品拿满分,V4 Flash 只写得出「AI口语教练」这种泛称。

4. 成本最拧巴。官方说「成本更低」,但单价跟 V4 Flash 一模一样,没降。有开发者测完看账单:「5 分钟 10 块」「瞬间几十块没了」。速度翻倍、同样时间烧的 token 更多,账单自然见涨。官方说的低成本,是指完成同一件事的 token 消耗更少,能不能省到钱,得等正式版。

5. 问卷把算盘问出来了。内测问卷里专门问:V4.1 Flash 能不能全面替换线上的 V4 Pro。9/9 又宣布 Flash 系列 9/10 全线降价,缓存命中最高降 60%(每百万 token 缓存命中输入降到 0.02 元)。Flash 越来越快还越来越便宜,Pro 的活在被一点一点接走。

V4 系列两个月五步:7/31 V4 Flash 公测、8/13 V4 Pro 发布、8/21 Vision-Exp 上线、8/31 开源、9/8 V4.1 Flash 开测。中间版本越来越多,迭代越来越密,这回连名字都带保质期。

#DeepSeekV4.1Flash中间版本内测##AI#

发布于 上海