8 月 26 日,英伟达宣布 Groq 3 LPX 全面投产,Vera Rubin 推理芯片效率数倍提升。基于 SemiAnalysis 的 AgentX 工作负载、采用 DeepSeek V4 Pro 模型测试,Vera Rubin 每兆瓦吞吐量最高达到上一代 GB300 NVL72 的 30 倍,每 Token 成本最高降低 35 倍。SpaceXAI 将采用 Vera CPU 加速下一代智能体 AI。
讲真,这组数据什么概念?上一代产品推理 1000 个 Token 花 35 块钱,Vera Rubin 只花 1 块钱。成本降 35 倍,意味着什么?意味着 AI 推理从 "奢侈品" 变成 "日用品"—— 以前只有大厂用得起,现在中小企业甚至个人开发者都能用得起。这才是 AI 真正的 "iPhone 时刻"—— 不是模型多聪明,是成本降到人人用得起。
但问题也来了,技术无法长期领先,真要平民用,那就真是平民价,那就换到中国芯片的机会来了
发布于 北京
