🤖 智谱电话会全拆解:涨价101%用量反增40倍,ARR剑指24亿美元,坦言落后Anthropic 17个月
一句话定性:中国大模型第一次用"量价齐飞"证明了AI商业化的可行性——价格翻倍、用量暴涨,这不是降价换量,是模型能力变现。
一、ARR:从2.5亿到24亿的"脉冲式"狂飙
智谱上市以来仅三次官方披露ARR:
时间 ARR 阶段
3月31日(年报) 2.5亿美元 起点
7月 10亿美元 破10亿
8月末 16亿美元 当前
年底指引 24亿美元 🎯
💡 5个月 6倍增长。曲线呈"脉冲式"——肖磊解释扰动来自算力供给阶段性错配(6月底曾停在5.3-5.4亿)。
对标Anthropic:当前16亿美元 ≈ Anthropic 2025年3月水平,落后约17个月,但已从起步的24个月差距缩短7个月。
二、量价齐飞:商业史上罕见的组合
这是全场最炸裂的数据:
📈 API均价提升约101%(翻倍)
📈 token调用量较年初增长超40倍
📈 前十大客户日均调用量增长98倍,贡献近40%流量(40万亿token中占超15万亿)
Coding Plan更极端:上线365天调用量增长234倍;上半年因算力不足停止销售,7月算力改善后才重新开放,涨价后8月调用量仍增长15倍。
💡 肖磊的原话最精准:"这不是我们主动设计的结果,而是模型能力本身的提升带来的自然演进"——涨价不萎缩,说明需求是刚性的、由效果驱动。
三、毛利率:12-18个月奔向50%
上半年开放平台毛利率 24.6%,肖磊给出方向性指引:12-18个月内奔向50%。
当前偏低的原因(四点):
1.国产大集群尚处爬坡期(成本先行,利用率逐步填满)
2.模型迭代快带来切换损耗
3.Infra优化仍有空间(过去半年单位推理成本已降80%)
4.产品定价精细化(旗舰模型 + Flash智能路由,减少错配)
💡 成本曲线开始掌握在自己手里——这是董事长刘德斌的原话。下一阶段重点不是"国产卡能不能跑",而是"怎么验证国产卡的经济性"。
四、国产替代:GLM-5.3 Flash全程跑在国产芯片上
历史性细节:GLM-5.3 Flash曾以匿名模型"Ox-Alpha(牛来模型)"身份上线OpenRouter和OpenCoder测试——六天调用量超62万亿token,上线首日冲至OpenRouter榜首。
关键在这句:这是第一次在超大规模真实流量中,全面使用国产芯片集群提供服务的模型。
✅ 已实现 10万卡级国产芯片规模化推理
✅ 单位token推理成本较年初下降80%
🎯 未来3-6个月,先进国产芯片厂商可能开始放量,异构并行环境有望显著改善
💡 中国AI的"国产替代"叙事,从今天起有了真实验证:不是能不能跑,而是满不满意经济性。
五、大客户 + 出海:破圈证据
🇨🇳 中国前十大互联网公司中,4家已将GLM列为全球首要选择(与海外模型相比,GLM是第一选择)
🌍 已与 AWS 在分发层面启动初步合作
🌍 正与欧美两家较大云服务商及独立模型公司洽谈(1-2个月内有进展分享)
🌍 开源态度明确:"市场足够大,弱水三千取一瓢饮"——不靠闭源换份额
六、技术路径:唐杰详解"Fully Self-Training"
首席科学家唐杰提出下一代模型三个方向:
1️⃣ 继续扩大基座规模 + Loop Transformer架构创新(提升有效推理深度,同时降低推理成本)
2️⃣ 大幅加强后训练:GLM-5.3效果跃升的关键——"在数据环境上搭建了几十倍的数据环境"
3️⃣ 🎯 Fully Self-Training(终局):模型从预训练到后训练全程自主进行,能自我纠错、自我停止
对应海外RSI(Recursive Self-Improvement)。最大难题:模型能不能判断自己、何时停止、何时纠正
回应"只会后训练"质疑:GLM-5系列用 7440亿参数基座(今年1月确定,规划使用超半年),依次走5.1→5.2→5.3中训练+后训练路线。下一代基座"出来第一天就能让大家满量用得上"。
七、一句话总结
智谱用"涨价101%却用量增40倍"击穿了"AI只能降价换量"的叙事——这是模型能力变现的首个硬证据。ARR 24亿美元指引 + 国产芯片10万卡满血跑 + 毛利率奔50%,三条线共同指向一件事:中国大模型从"讲故事"进入"算账期"。差距是客观的(落后Anthropic 17个月),但缩短速度是真实的(24个月→17个月)。
验证节点:① 年底ARR 24亿能否兑现 → ② 毛利率向50%爬坡 → ③ 国产卡经济性验证 → ④ 1-2个月内出海合作落地
#智谱# #GLM# #AI商业化# #ARR# #国产替代# #FullySelfTraining# #大模型# #9月2日#
发布于 江苏
