这次GLM-5.3-Flash让我比较在意的,其实不只是模型参数或者跑分,而是两个字:开放。
320B-A18B架构,MIT许可证开放权重,同时还用了稀疏注意力和线性注意力的混合架构,重点就是想把长上下文的成本压下来。
对于开发者来说,这些东西比一句“性能提升多少”更实际。
因为模型再强,如果调用成本太高、部署太麻烦,最后也很难真正进入产品。
现在开源模型越来越卷,我觉得这是好事。
模型能力往上走,价格往下走,开发者手里的选择越来越多。
最后真正受益的,还是那些每天拿AI干活的人。
#智谱发布GLM5.3Flash#
发布于 上海
