英伟达开源大模型双响炮,万亿参数旗舰也在路上

2026-08-13 12:29 来源:技术脉络观察

  英伟达刚在8月11日正式发布了一款名为Nemotron 3.5 Lightning的开源大模型,紧接着又被曝出正在秘密研发一个参数规模至少万亿级别的“王炸”级开源模型Nemotron 4,直接瞄准全球最强开源模型的宝座。

  英伟达在开源大模型领域打出了一套“双响炮”,既有已上架的轻量级现货,也有正在研发中的旗舰级期货,核心目的都是通过开源软件生态来拉动其GPU硬件的需求。

  

  

  一、已发布的“现货”:Nemotron 3.5 Lightning

  产品定位:这是一款300亿总参数(激活30亿参数)的混合专家(MoE)模型,专为高频调用、持续在线的AI智能体(Agent)任务打造,比如工具调用、子任务委派等。

  核心优势:输出速度最高可达同类模型的4倍,处理1万个Agent任务比同级别模型快30%,其权重、训练数据和方案均以OpenMDW-1.1商用许可协议完全开源。

  硬件门槛极低:它具备“轻量高效”的特性,可直接在普通笔记本电脑或台式机的单块消费级GPU上流畅运行,极大降低了开发者的使用门槛。

  搭配工具:英伟达同步开放了模型路由库NeMo Switchyard,可以自动将简单任务分配给这个小模型,复杂任务再调度大模型,从而帮助企业大幅降低整体AI调用成本。

  二、正在研发的“期货”:万亿参数旗舰Nemotron 4

  研发目标:英伟达正全力研发Nemotron 4系列旗舰版,目标参数规模至少达到1万亿,约为前代旗舰Nemotron 3 Ultra的两倍,旨在对标全球顶尖的开源大模型。

  研发进展:该项目由规模庞大的团队负责,目前仍在训练中,参与项目的员工透露,该模型最快可能于2026年秋末准备就绪。

  技术策略:英伟达并未盲目堆砌参数,而是非常重视模型压缩技术。通过压缩,即使在万亿参数级别下,更小体量的模型也有望实现更优的表现,兼顾了性能与落地成本。

  三、开源战略背后的“阳谋”

  拉动硬件销售:这是最直接的商业逻辑。通过开源顶级模型,吸引全球开发者和企业使用,抢占“最好用的开源模型”位置,最终所有训练和推理需求都会回流到其GPU芯片上,形成“软件赋能硬件”的闭环。

  巩固开发者生态:开源免费模型能让开发者快速上手并形成依赖,从而将开发者牢牢绑定在英伟达的CUDA生态内,构建更坚固的护城河。

  应对市场竞争:面对Meta等巨头对开源模型的投入以及中国低成本模型的追赶,英伟达亲自下场做顶级开源模型,也是为了在开源赛道上保持绝对领先地位,避免市场被竞争对手抢占。