妖慧慧
26-09-18 23:45 微博认证:情感博主

#智谱GLM5.3FlashX模型上线#智谱正式上线GLM‑5.3‑FlashX,API同步对外开放。
它是之前火出圈的GLM‑5.3‑Flash(外号“牛来”)的升级版本,依旧是原生多模态模型,支持图文、视频、文件输入。

最大亮点就是速度,推理最高可以跑到200 tokens/s,相比旧版Flash速度直接提升5倍,输出响应会流畅很多,适合高并发、需要快速交互的场景。
不过速度提升的同时,定价也涨到原版的2.5倍,相当于用更高成本换取极致的生成速度。

这套模型背后依托十万张国产芯片搭建的推理集群,上线之后算力直接被打满,能扛住大量开发者调用需求。
模型能力保持原有水准,适合企业、开发者做AI交互、智能体、文档处理、多模态分析这类业务。

网友也讨论,对于普通个人用户,旧版Flash性价比更高;如果是追求极速响应、大批量调用的开发场景,FlashX会更合适。 http://t.cn/AXONxE5i

发布于 江西