新智元
25-08-19 10:43 微博认证:新智元官方微博

刚刚,英伟达发布了一个只有9B大小的NVIDIA Nemotron Nano 2模型。

对标的是业界标杆,千问的Qwen3-8B,但这个模型是一个完全不同的混合架构。

用英伟达的说法,这是一款革命性的Mamba-Transformer混合架构语言模型。

在复杂推理基准测试中实现了和Qwen3-8B相当或更优的准确率,并且吞吐量最高可达其6倍。

Nemotron-Nano-9B-v2的强大,源于其创新的Nemotron-H架构。

用闪电般快速的Mamba-2层,替换了传统Transformer架构中绝大多数的自注意力层。

当模型需要进行长篇大论的思考、生成复杂的长思维链时,它的推理速度得到了史诗级的提升!http://t.cn/A6sDxrjg