互联网三爷
26-07-20 11:49 微博认证:科技博主

#Kimi K3引发算力逻辑讨论#
最近 Kimi K3 上线直接吵翻 AI 圈,不少人说新架构省资源,以后显卡不用抢了,其实完全想反了。

看着单次跑模型更省内存,但它整体模型体量巨大,全套参数存储极度吃高显存显卡,多卡协同传输还对服务器互联要求更高。

最直观的现实就是上线没几天服务器直接扛不住,紧急暂停新用户注册。技术优化只会降低单次使用成本,反而吸引大批量用户疯狂使用,各类长文本、智能代理需求爆发,算力消耗只增不减。

现在比拼早就不是单张显卡强弱,而是整套集群的承载能力。

所谓架构减负并不会削弱算力硬件价值,需求只会跟着模型能力同步扩张,算力产业链长期逻辑没变!

发布于 浙江