爱可可-爱生活
26-08-24 12:06 微博认证:AI博主 2025微博新锐新知博主

【AI芯片大逃杀:这不再是一场算力的竞赛】随着摩尔定律失效,通用架构正在被领域特定架构取代。NVIDIA靠CUDA生态和NVLink互联确立了统治地位;AMD通过堆叠HBM容量和开源ROCm试图在推理成本上突围;Google TPU和AWS Trainium则利用垂直整合将编译器调度发挥到极致。更有Cerebras这种直接把整块晶圆做成芯片的怪兽,以及Groq这种追求绝对确定性、连缓存都不要的极简主义者。芯片设计的核心矛盾已经从“如何算得快”转向了“如何搬运数据”。所谓的Memory Wall不是一个技术参数,而是物理极限的围墙。NVIDIA的护城河不在于芯片本身,而在于过去二十年积累的软件生态和那群习惯了CUDA的工程师。但当Agent开始接管底层代码编写,这种生态壁垒可能会被暴力计算和新的存储架构瓦解。与其迷信FLOPS指标,不如关注带宽效率和显存容量。未来芯片可能不再是独立存在的个体,而是以机柜为单位的巨大互联实体,甚至会演变成AI与芯片的协同进化。

发布于 北京