爱可可-爱生活
26-07-24 08:48 微博认证:AI博主 2025微博新锐新知博主

【英伟达的护城河裂开了缝:CUDA代码零成本跨越苹果芯片】OpenFPM社区近期实现了一项技术突破,通过一套复杂的编译器转换链,让原本只能在英伟达GPU上运行的CUDA代码,在不修改任何源码的前提下直接跑在了苹果Silicon的Metal架构上。在重度3D流体模拟测试中,这套转换层几乎实现了零性能损耗,速度比CPU快了10倍,且完全开源。这意味着苹果设备在理论上已经具备了运行原本专属于英伟达集群代码的能力。长期以来,英伟达最硬的底牌不是硬件参数,而是开发者对CUDA生态的路径依赖。虽然这次突破目前仍集中在特定框架,且苹果的统一内存与英伟达的离散显存逻辑在底层优化上仍有差异,但它证明了翻译层可以做到不损失效率。这不仅是给开发者省下了重写代码的力气,更是在动摇AI算力市场的排他性协议。即便优化上限仍有距离,但能跑通本身就是打破垄断的开始。 x.com/HowToPrompt__/status/2080317864427614656

发布于 北京