谢小斌
26-08-26 22:33 微博认证:数码博主 数码测评师 汽车测评师 旅行摄影师 头条文章作者

#阿里发布Qwen3.8Flash#阿里全新推出的多模态MoE模型Qwen3.8‑Flash重磅亮相,主模型拥有125B参数量,额外搭载51B的N-gram Embedding,推理时每token仅激活6B参数,训练开销直接降至上代Qwen3.7-Plus的九分之一,真正做到降本不降性能,编码、办公场景能力全面升级。

这次模型进行了全方位底层架构升级,四大优化亮点十足。创新的GDN+QSA混合注意力机制,兼顾信息记忆与精准检索;门控残差通路拓宽信息传递通道,提升训练稳定性;51B超大Embedding以极低算力成本扩充模型记忆库;搭配全新优化器重构训练逻辑,大幅提升训练效率。

目前该模型超低定价上线千问AI平台,同时首发入驻千问办公,相关开源权重也已公开,更是新一代Qwen4架构的雏形。

不得不说这次技术落地很务实,但架构优化和亮眼定价只是加分项。低激活算力能否稳住高并发、复杂任务场景的稳定性,还需要广大开发者实测,才能真正验证这款模型的落地价值。#qwen3.8flash# http://t.cn/AXpHsBR7

发布于 浙江