【#英伟达发布旗舰模型Nemotron 3#,混合MoE架构+100万token上下文】
据华尔街见闻报道,英伟达周一发布最新版系列开源人工智能模型“Nemotron”,以及配套的数据和库,旨在为各行各业提供透明、高效、可定制的智能体AI(agentic AI)开发能力。该公司表示,这一新模型家族在速度、成本和智能水平方面都将优于此前的产品。
Nemotron 3模型系列包括Nano、Super和Ultra三个版本,引入了一项突破性的混合潜在专家混合(latent Mixture-of-Experts,MoE)架构,帮助开发者以规模化方式构建和部署可靠的多智能体系统。
该公司表示,周一已经上线的Nemotron 3 Nano相比上一代产品效率更高,即运行成本更低,同时在处理包含多个步骤的长任务时表现更好。另外两款体量更大的版本预计将在2026年上半年推出。
在Artificial Analysis Intelligence Index v3.0中,Nemotron 3 Nano在同规模模型中以52分排名领先。
英伟达还为Nemotron 3 Super和Ultra模型引入了另一项创新。Briski表示,公司在这些模型中部署了一项名为“潜在MoE(latent MoE)”的突破性技术,即专家在共享的潜在表示空间中工作,之后再映射回token空间。这种方式在相同推理成本下,可调用多达4倍数量的专家,从而在语义细节、领域抽象和多跳推理方面实现更高水平的专门化。
