AIGC·非著名程序员
26-08-27 07:16 微博认证:微博新知博主 科技博主 头条文章作者 微博原创视频博主

智谱正式发布了「牛来模型」GLM-5.3 Flash,又便宜又能打的轻量旗舰。

还记得前阵子 OpenRouter 上突然冒出来一个叫 Ox Alpha 的匿名模型吗?五天时间流量就破了平台历史纪录的四倍,全网开发者都在猜它到底是谁家的。现在谜底揭晓了:智谱的 GLM-5.3 Flash。

这个模型参数量 321B,跟 DeepSeek V4 Flash 差不多体量,但架构完全重新设计过。它跟自家大哥 GLM-5.3 走的是不同的路线,底层的混合注意力机制被整个重写了一遍。每次激活的参数从 32B 砍到了 18B,注意力计算量降了三倍,KV 缓存降了四倍多。说白了就是:干同样的活,消耗的算力少了一大截,所以成本能压得很低。

那它到底有多能打?根据评测,GLM-5.3 Flash 的 AI 智能分数是 57 分,超过了上一代旗舰 GLM-5.2,跟 Claude Opus 4.8 持平,甚至比 DeepSeek V4 Pro 正式版的 53 分还高。换句话说,一个轻量级模型,智能水平已经摸到了顶级旗舰的门槛。

再看价格,就更离谱了。输入 0.8 元、输出 2.8 元每百万 token,上线前两周还半价。对比涨价后的 DeepSeek V4 Flash,综合成本便宜了一截。社区里有人总结得很到位:Opus 4.8 的能力,四十分之一的价格。

还有个很关键的信息:这个模型全程跑在国产芯片上。10 万张以上的国产卡集群,扛住了 Ox Alpha 匿名测试期间全球开发者涌入的恐怖流量,智谱官方说硬件效率和单位 token 成本已经达到了英伟达 GPU 相当的水平。这对国产算力生态来说是个很硬的证明。

另外,GLM-5.3 Flash 还是智谱战略转向 coding 之后第一个带原生多模态能力的新模型,支持图像和视频输入。社区开发者已经拿它写了五六十万行代码从零搓出泰拉瑞亚,还有人让它在 Blender 里独立完成 400 平米豪宅的建模渲染,前端还原设计稿更是像素级的。

GLM-5.3 Flash发布的时机简直恰到好处。DeepSeek 八月全面涨价,V4 Flash 输出价格翻了一倍多,OpenCode 上调用量直接掉了一半。这部分流失的需求,就成了国产模型厂商新的增长空间。智谱这一刀切进来,时机卡得很准。

我感觉轻量旗舰这个赛道,接下来只会更卷。

#智谱发布GLM5.3Flash# #科技先锋官##How I AI#

发布于 山东