袁国庆
26-08-26 22:08 微博认证:科技博主 微博原创视频博主

阿里今晚又放大招了,正式发布 Qwen3.8-Flash。

它的主模型参数量达到125B,还额外配备51B的 N-gram Embedding,但每次真正被激活的参数只有约6B。

简单来说,这个模型有点像一辆“大排量发动机”,但平时开车并不会把所有马力都用上。

更夸张的是,训练开销约只有 Qwen3.7-Plus 的1/9。

AI模型不只是要越来越聪明,还得越来越省。

过去比的是“谁参数多、模型大”,接下来比的是“谁能用更少的算力,干更多的活”。

大模型的“降本增效”,可能才刚刚开始。

#阿里发布Qwen3.8Flash#

发布于 上海