十三个一倍
26-07-22 07:10 微博认证:财经博主 财经观察官

AI的上限突破还是得靠英伟达这种世界性巨头

英伟达称 rubin 量产并交付

23:55:37 【英伟达发布Vera Rubin平台进展:CoreWeave测试显示单位功耗Token吞吐提升10倍】财联社7月21日电,英伟达7月21日宣布,面向“千兆级AI工厂”的Vera Rubin平台正在全球扩大部署,CoreWeave、谷歌云、微软Azure和甲骨文云等已开始采用Vera Rubin NVL72系统。英伟达称,CoreWeave测试显示,Vera Rubin NVL72相比Grace Blackwell NVL72,每兆瓦可实现10倍Token吞吐提升。该平台整合Vera CPU、Rubin GPU、NVLink 6、ConnectX-9 SuperNIC、BlueField-4 DPU及Spectrum-6交换系统,旨在提升AI训练和推理效率。英伟达表示,Vera Rubin已覆盖全球350多个工厂节点、30个国家,目标是降低AI基础设施成本并提高能源利用效率。

23:50:35【英伟达详解下一代AI专用Vera CPU 称速度是其他CPU的两倍多】财联社7月21日电,英伟达发文称,DeepInfra的基准测试结果显示,NVIDIA Vera CPU的速度是其他CPU的两倍多,并且能够支持更多并发的AI代理。云平台DeepInfra是NVIDIA开放AI生态系统的早期体验参与者,独立设计并运行了基于其生产型AI代理基础设施的基准测试。DeepInfra每周处理近五万亿个代币,其中约30%由代理系统驱动。其云平台专为高通量AI推理而建。基准测试显示,在相同服务质量下,支持最多1.6倍的并发AI代理,协同速度高达2.2倍,同时提升基础设施利用率和成本效益。这些结果表明,NVIDIA Vera CPU 能够实现生产代理人工智能所需的成本效益、低延迟和吞吐量。

随着AI代理承担更复杂的推理、规划、工具使用和数据流动,CPU性能在围绕每次模型调用的协调工作中变得越来越重要。作为英伟达对AI工厂极端联合设计策略的一部分,Vera CPU专为代理性工作负载设计。DeepInfra的基准测试强调了NVIDIA Vera CPU如何帮助云服务提供商提升基础设施利用率、提高成本效率,并在相同服务质量下支持更多并发的AI代理。

英伟达7月21日发布新一代Spectrum-6以太网交换系统,用于支持基于Vera Rubin平台的超大规模AI基础设施。该系统单交换容量达102.4Tbps,是上一代产品的两倍,旨在连接数十万级GPU和CPU,为大规模AI训练、智能体应用及推理任务提供网络支持。英伟达表示,Spectrum-6将作为下一代Spectrum-X Ethernet平台核心组件,通过高带宽、智能流量管理和故障恢复能力,提升AI工厂整体计算效率。CoreWeave、微软、Nebius、SpaceXAI和特斯拉等AI基础设施建设者将成为首批部署用户。#a股##美股#

发布于 江西