晚点LatePost
26-08-26 23:20 微博认证:晚点LatePost 官方微博

#智谱GLM5.3Flash由10万张国产卡支持#【晚点独家丨#智谱推出对标DeepSeek的轻量旗舰模型#,由10万国产卡支持】智谱发布旨在对标 DeepSeek V4 Flash 的轻量级旗舰模型 GLM-5.3 Flash ,调用超过 10 万张国产芯片集群用于该模型推理服务。据《晚点 LatePost》了解,其算力供应商或来自华为、摩尔线程与海光,智谱官方没有评论这一信息。

GLM-5.3 Flash 拥有 300B 参数规模, 参数量约为 GLM-5.3 的 40%,与 DeepSeek V4 Flash 几乎持平。与同代小尺寸模型往往蒸馏自大模型不同,GLM-5.3 Flash 采用与 GLM-5.3 不同的架构设计,具有原生多模态能力,支持图像视频输入,这也是智谱战略聚焦 coding 以来第一次推出具有多模态能力的新模型。

随着 AI 模型能力持续提升,轻量旗舰模型能够负担越来越多的工作任务,这创造了新的增长空间,8 月 DeepSeek V4 Flash 的提价不仅证明了市场强劲需求,也预示了更激烈竞争的到来。

根据《晚点 LatePost》看到的智谱内部评测, GLM-5.3 Flash 的 Artificial Analysis Intelligence 分数为 57 分。这一分数超过上一代旗舰模型 GLM-5.2,和 Claude Opus 4.8 持平,也高于 DeepSeek 旗舰模型 V4 Pro 正式版的 53 分。

GLM-5.3 Flash 每百万 token 输入 0.8 元,输出 2.8 元,缓存命中价格 0.23 元,正好为 GLM-5.3 的十分之一。横向对比调价后的 DeepSeek V4 Flash,其谷时价格分别为 1.5 元、4.5 元 和 0.05 元。综合输入和输出成本,GLM-5.3 Flash 在绝大多数常规调用场景下更便宜。

智谱已经表示,上线前两周 GLM-5.3 Flash 会实行半价。

正式发布前智谱已在包括 OpenRouter 在内的第三方开放平台以 Ox Alpha 名义测试,5 天流量累积据悉超过 50 T,由于完全免费,刷新了 OpenRouter 与 OpenCode 流量增长纪录。

这不是智谱第一次以匿名形式发布新模型,今年春节前夕,OpenRouter 上出现一个名为 Pony Alpha 的模型,名字呼应中国农历马年,后来被证明是智谱的 GLM-5 模型。 http://t.cn/AXpQLUsq

发布于 北京