大反转!Kimi K3非但没“杀死”算力,反手给英伟达加了把火
今天说个反常识的瓜。
Kimi K3说要上“线性注意力”,市场第一反应:完了,算力要凉,英伟达要挨刀,HBM要过剩。结果国际半导体机构SemiAnalysis直接掀桌子——全理解反了!
来,算笔硬账:K3参数2.8万亿,光模型权重就得1.5TB的HBM来装。线性注意力优化的是KV缓存,但模型权重一点没少,该占的HBM照样占。官方还说了,高效推理至少需要64颗芯片组团上——就是冲着英伟达GB200 NVL72那种机架级巨无霸去的。缓存确实省了点,但芯片集群规模反而更大了。
这叫啥?经济学里有个词叫“杰文斯悖论”——越省油,开车越猛,油烧得越多。线性注意力降低的是单次推理成本,AI门槛一低,用的人暴增,算力总盘子只会越滚越大。
落到A股,别在算力芯片的过山车里当韭菜。真正的硬逻辑两条:
1. HBM需求只增不减。 模型权重硬性占用就在那,国产存储链、先进封测、内存接口都是硬缺口。
2. 集群规模越大,互联越缺。 64颗芯片互联,高速铜连接和光模块比GPU还紧俏,外加高端PCB、液冷温控,确定性拉满。
市场总用"线性思维"理解"线性注意力",结果被按在地上摩擦。这波认知差,谁先醒谁吃肉,等机构研报铺天盖地时,黄花菜都凉了。
发布于 广东
