#Kimi K3引发算力逻辑讨论#Kimi K3发布后,彻底打破行业“堆卡堆参数”的固有算力认知。依靠KDA线性注意力、稀疏MoE架构,它大幅降低长文本推理损耗,却又因百万级上下文、多专家调度,拉高集群互联与内存需求。市场也因此争论:架构优化究竟会缓解算力紧缺,还是催生全新硬件需求。http://t.cn/AX9AUG26
发布于 江西
