阿里今晚又放大招了,正式发布 Qwen3.8-Flash。
它的主模型参数量达到125B,还额外配备51B的 N-gram Embedding,但每次真正被激活的参数只有约6B。
简单来说,这个模型有点像一辆“大排量发动机”,但平时开车并不会把所有马力都用上。
更夸张的是,训练开销约只有 Qwen3.7-Plus 的1/9。
AI模型不只是要越来越聪明,还得越来越省。
过去比的是“谁参数多、模型大”,接下来比的是“谁能用更少的算力,干更多的活”。
大模型的“降本增效”,可能才刚刚开始。
#阿里发布Qwen3.8Flash#
发布于 上海
