#智谱GLM5.3FlashX模型上线#
9月18日智谱发布极速版GLM‑5.3‑FlashX,API已经开放调用。
峰值输出速度最高200 tokens/s,是Flash原版的5倍,长文本生成响应更快。
但定价也涨到原版的2.5倍。
模型能力不变,100万上下文,支持图片视频多模态。
适合高并发、要实时输出的业务;普通场景依旧可以用性价比版Flash。
速度提升的同时成本上涨,开发者可以按需取舍。
发布于 河南
#智谱GLM5.3FlashX模型上线#
9月18日智谱发布极速版GLM‑5.3‑FlashX,API已经开放调用。
峰值输出速度最高200 tokens/s,是Flash原版的5倍,长文本生成响应更快。
但定价也涨到原版的2.5倍。
模型能力不变,100万上下文,支持图片视频多模态。
适合高并发、要实时输出的业务;普通场景依旧可以用性价比版Flash。
速度提升的同时成本上涨,开发者可以按需取舍。