爱可可-爱生活
26-08-27 07:24 微博认证:AI博主 2025微博新锐新知博主

【国产模型“Ox Alpha”揭面:GLM-5.3-Flash用中国芯片硬刚硅谷】智谱Z.ai正式发布GLM-5.3-Flash,揭开了此前在OpenRouter上霸榜的神秘模型“Ox Alpha”的真面目。这是一款拥有320B参数但激活参数仅18B的混合专家模型(MoE),在编程和智能体任务上直逼Claude Opus 4.8,而成本仅为其十分之一。最耐人寻味的是,这波全球范围的高并发流量全是在国产AI芯片集群上跑通的,通过模型辅助代码优化,智谱把国产硬件的推理效率提升了3倍,生生在算力封锁中杀出一条“高性价比”的血路。这件事标志着大模型竞争进入了“算账时代”。当硅谷还在卷万亿参数和昂贵的H100集群时,国内厂商已经靠着极致的架构压缩(如线性注意力和稀疏注意力混合)和软硬一体优化,把“前沿智能”做成了“白菜价”。对开发者来说,这意味着本地运行300B级模型不再是幻梦,甚至能通过多模型组合——用昂贵的闭源模型做架构规划,用廉价的Flash模型跑24/7的自动化执行——实现ROI最大化。在生产力工具属性上,国产模型正凭借“量大管饱”的韧性,瓦解算力霸权的护城河。

发布于 北京