梁文峰内部交流关于算力和国产芯片部分
1. 中美 AI 的差距只有一件事:卡不够。 人才两边是同一批人,模型、应用的差距追根溯源都是算力差距——美国能训 800B 激活的模型,国内只训得起几十 B,差一个数量级。
2. 钱不是拿来存的,是拿来换卡的。 梁文锋说最理想的状态是半年内把融资全花成英伟达卡——存银行两个点利息,买卡十个月回本,只愁买不到,不愁花得快。
3. CUDA 的护城河正在被填平,而且是三重夹击。 AI 自己能写代码建生态了;DeepSeek 自研的 TileLang 用很短的代码就能重写整套算子;芯片和游戏卡解耦后,专用芯片本来就不该绑定 CUDA。
4. V3 已经在用英伟达的卡、走自己的路了。 训练用英伟达硬件,但生态几乎不碰 CUDA——硬件暂时绕不开,软件依赖先斩掉,同一套做法搬到华为卡上只是时间问题。
5. 华为 950 超节点能平替 GB300,代价明牌:四张顶一张,落后两年。 性能、任务、延时都对得上,价格贵一倍以内都能接受——这不是"够用就好"的安慰,是工程上算得过来的账。
6. 国产卡现在唯一的真问题是产能,不是生态。 华为只能给 DeepSeek 约 1.6 万张 950(约当 4000 张 B 系列),比大厂少一个数量级——不是不好用,是造不出来那么多。
7. 一年内,"国产卡生态不行"这个说法会被事实终结。 这是梁文锋自己立的时间表:天时地利都齐了,就差时间。
8. 接下来的目标是把"落后"两个字越写越小。 过去的叙事是"落后一两年、用二十分之一的算力做出来",新的目标是用几分之一的算力、把差距压到三到六个月,局部还能反超。
9. 英伟达真正的对手不是华为,是它自己。 生态护城河靠 AI 就能复制、专用芯片又天然解绑 CUDA,所以梁文锋说"英伟达在掘自己的坟墓"——壁垒是被技术进步拆掉的,不是被谁攻破的。
发布于 浙江
