小哥测评
26-09-15 01:50 微博认证:搞笑幽默博主

官方表示,GLM-5.3-Flash 在各项基准测试和实际使用中,全面超越参数量高出一倍的 GLM-5.2,定价却仅为后者的 1/10。
据介绍,这得益于其全新模型架构。GLM-5.3-Flash 的架构专为极低成本而设计,总参数量与 GLM-4.5 相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合最新的 30T Token 多模态预训练语料,GLM-5.3-Flash 能够以更少的计算资源实现更强的性能。
GLM-5.3-Flash 同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型 Scaling 能力。
官方表示,GLM-5.3-Flash 视觉能力被原生融入 Coding 循环,使模型能够主动观察界面、渲染结果与交互反馈,并据此持续测试和改进。无论是前端开发、游戏构建、Blender 3D 场景,还是 BUA、CUA 驱动的真实环境操作,模型都能在代码、浏览器和图形界面之间协同完成任务。#井柏然曾被问有没有爱上过对手#

发布于 广东