今天是真热闹,阿里刚发完 Qwen3.8-Flash,智谱紧跟着就把 GLM-5.3-Flash 端上来了。
两大厂同一天发 Flash,不是巧合,是信号
大模型卷完参数,现在正式开卷效率了。
给普通人翻译一下 Flash是啥:就是在效果基本不掉队的前提下,把推理速度拉满、把调用成本打下来的版本。你用 AI 的时候感觉就是 —— 回复更快了,花钱更少了。开发者那边更直接,同样的预算能跑更多请求,AI 嵌进产品里不再心疼 token 钱。
智谱这波跟进速度很快,国产基础模型的 效率之战 算是正式打响。坐等两家实测数据对线,有结果第一时间跟大家聊。#智谱发布GLM5.3Flash#
发布于 浙江
