#a股##rubin##算力# 【Rubin备受期待之际 英伟达持续优化Blackwell GB200能效三个月翻4倍】
英伟达正以持续的软件栈优化延长Blackwell平台的生命周期,同时为下一代Rubin架构的规模化落地蓄力。
在新一代Rubin平台加速部署的背景下,英伟达披露,仅用三个月时间,便将GB200 NVL72在运行DeepSeek R1 0528模型时的每兆瓦算力吞吐量(TPS/MW)提升了4倍。这一成果源自英伟达在四个月内完成的38项重大优化,背后支撑为逾25万次模拟配置测试及累计140万GPU小时的优化验证。
与此同时,GB300"Blackwell Ultra"平台在AI训练基准测试中持续刷新纪录。256卡规模下,GB300 NVL72在DeepSeek-V3 671B预训练任务中以每GPU 1648 TFLOPs的成绩创下历史最高纪录,较GB200的606 TFLOPs提升约3倍,且该指标在过去六个月内已累计提升1.5倍。(华尔街见闻) http://t.cn/z8ADYQE
发布于 浙江
