#智谱发布GLM5.3Fla#
9月18日智谱正式推出GLM-5.3-FlashX极速大模型。
模型最高推理速度可达200 tokens/s,相比前代GLM-5.3-Flash提速5倍,面向高并发、实时交互场景。
API定价调整:输入2元/百万Tokens,输出7元/百万Tokens,为原版2.5倍。依托超10万张国产AI芯片集群,在国产算力底座上完成速度与商业化的双重突破。
发布于 新疆
#智谱发布GLM5.3Fla#
9月18日智谱正式推出GLM-5.3-FlashX极速大模型。
模型最高推理速度可达200 tokens/s,相比前代GLM-5.3-Flash提速5倍,面向高并发、实时交互场景。
API定价调整:输入2元/百万Tokens,输出7元/百万Tokens,为原版2.5倍。依托超10万张国产AI芯片集群,在国产算力底座上完成速度与商业化的双重突破。