IT九熙
26-08-26 22:28 微博认证:科技博主

#阿里发布Qwen3.8Flash#最近大模型行业很有意思,不少厂商都在上调API价格,而阿里这次放出Qwen3.8‑Flash,算是逆向打出一张性价比王牌。#微博视频号续航计划#

它是一款多模态MoE模型,总参数125B,但每个token仅激活6B参数,训练开销只有上一代Qwen3.7‑Plus的九分之一。简单说,就是用很低的算力开销,扛住长文本、编码、办公这类高频任务。

更值得关注的一点,Qwen3.8‑Flash‑Next其实是Qwen4架构的技术预演。新架构没有优先给到旗舰大模型,反而下放到主打性价比的Flash版本,能看出阿里的思路:先在高并发场景打磨新架构,再往全线产品落地。

放在当下的行业环境看,现在Agent应用爆发,单次任务动辄几十次模型调用,成本压力被成倍放大。只看纸面参数已经不够,每完成一次真实任务花多少钱,才是开发者最关心的指标。

在行业集体涨价的大环境下,这一版把成本和能力做了新平衡,会给开发者、企业选型带来新的选择。

大家觉得,接下来大模型是继续拼参数,还是卷任务实际使用成本?#ai创造营# http://t.cn/AXpQvjyV

发布于 北京