轩雨sprite
26-09-18 18:46 微博认证:电视剧博主 超话创作官(昀牵孟绕超话)

#智谱GLM5.3FlashX模型上线#
9月18日,智谱正式推出GLM-5.3-FlashX极速大模型,同步开放API接口,引发AI行业关注。该模型由国产芯片集群支撑,推理速度最高可达每秒200词元,相比前代GLM-5.3-Flash,速度直接提升5倍,能够应对高并发、大流量的生成需求。
GLM-5.3-Flash前身曾以匿名模型Ox Alpha在海外平台测试,一举拿下榜单高位,收获全球开发者的认可,调用量一度爆满。本次新升级的FlashX版本,在极速推理的基础上,保留了多模态、代码生成、复杂任务处理等原有能力,适配开发者、企业的各类AI开发场景。
随着大模型行业竞争进入新阶段,不再单纯比拼参数,推理速度与算力成本成为新的竞争焦点。智谱这款极速模型落地,也是国产大模型在算力工程层面的一次突破。不少业内人士认为,极速模型的迭代,能进一步降低高并发场景下AI应用落地门槛,为更多AI产品赋能。 http://t.cn/AXOCNwpo

发布于 湖南