川北小哥
26-08-26 22:07 微博认证:科技博主

#阿里发布Qwen3.8Flash#今晚阿里正式推出多模态MoE模型Qwen3.8‑Flash。总参数量125B,搭配51B的N‑gram Embedding,每token仅激活6B参数,训练开销仅为Qwen3.7‑Plus的1/9,极致的算力效率引发行业热议。

争议也随之而来:稀疏MoE架构纸面参数亮眼,但真实业务落地,激活参数少会不会带来稳定性波动?低成本是不是要牺牲部分综合能力。开源权重即将放出,开发者终于可以脱离跑分榜单,在本地环境实测真实表现。

如今大模型比拼不再只堆总参数,激活效率、推理成本,成为初创团队、个人开发者选型的核心标尺。国产模型持续压低使用门槛,给全球开发者提供全新选择。

纸面跑分固然好看,但真实业务场景的容错、工具调用、长任务稳定性,依旧需要大量实践检验。如果做开发,你会优先选择高性价比MoE模型吗?

发布于 宁夏