#牛来模型确认为智谱GLM系列#
智谱搞了个大新闻。
8月20日,一个叫Ox Alpha的模型悄悄上线OpenRouter,没署名、没官宣、没品牌。网友给它起了个外号:牛来。结果这"牛来"一上线,调用量直接冲上榜首,超过DeepSeek两倍,还终结了DeepSeek在OpenCode连续56天霸榜的纪录。
三天后,大家还在猜这是谁家的娃。有人说是智谱GLM,有人说是谷歌Gemini新版,还有人说是小米Mimo3。智谱自己憋着不说话。
直到今天,8月26日,智谱终于认了:牛来是我家的,GLM系列的新版本,今晚开放模型权重。
这操作,够骚。
先说说牛来到底什么水平。
OpenRouter上调用量第一,这个含金量不低。OpenRouter是个模型聚合平台,开发者可以随便切换模型,用脚投票。牛来能冲上榜首,说明开发者真觉得它好用,不是刷出来的。
具体参数也很亮眼。上下文窗口100万token,最大输出13.1万token,支持文本、图像、视频三模态。面向编程和智能体任务,DeepSWE软件工程基准测试63分,接近Claude Opus 4.8。
但最狠的是它的"隐身"玩法。
8月20日匿名上线,8月26日才认领。这六天里,牛来完全靠实力说话——没有品牌背书、没有营销造势、没有官方站台,纯靠开发者口口相传,硬是从零冲到榜首。这种"先考试再报名"的打法,在AI圈越来越流行。
字节、冬海、阿里,今年都玩过类似的匿名公测。逻辑很简单:模型好不好,让开发者说了算。如果匿名都能火,实名发布的时候势能更大。如果匿名没人用,那就悄悄下线,就当没这回事。
这比传统的"开发布会、请媒体、吹参数"靠谱多了。AI模型的性能, benchmark 分数可以刷,实际体验骗不了人。匿名公测相当于"盲测",把模型扔到真实使用场景里,让市场自己检验。
但匿名公测也有风险。最大的风险是"被截胡"——如果竞争对手在你认领之前,抢先发布类似性能的模型,你的"惊喜"就变成"跟风"了。牛来这次运气不错,六天里没人能拿出同级别的竞品,智谱认领的时候,市场已经认可了它的实力。
再说说牛来在智谱产品线里的位置。
智谱确认它是GLM系列的新版本,但没说是GLM-6还是GLM-5.x的升级。从分词器指纹分析看,它和GLM-5.3的token数量几乎完全吻合,只有75个token的包装层偏差。这说明它大概率是基于GLM-5.3架构的优化版,不是全新换代。
但这不代表它不重要。智谱的GLM-5系列,是它和Kimi K3、DeepSeek V3竞争的主力。牛来的出现,说明智谱在编程和智能体任务上有了显著进步——这两个场景,正是当前AI应用落地最热的方向。
和Kimi K3比呢?
Kimi K3强在通用能力和多步骤复杂任务,Arena.ai网页生成排第一,Artificial Analysis测试媲美GPT-5.5。牛来强在编程和智能体,OpenRouter调用量第一,DeepSWE测试接近Claude Opus 4.8。两家各有所长,不是简单的谁碾压谁。
和Fable 5比呢?
Fable 5是Anthropic的最强模型,Claude Opus 4.8的升级版,目前还是闭源状态。牛来在软件工程测试上接近它,但通用能力可能还有差距。不过牛来今晚开放权重,这意味着开发者可以免费下载、自己部署、随意修改。开源对闭源,这是牛来的最大优势。
匿名公测会成为未来AI发布的新玩法吗?
会,而且会越来越普遍。原因有三:
第一,市场太卷了。每个月都有新模型出来,开发者的注意力被严重分散。匿名上线可以制造悬念、引发讨论、自然传播,比花钱买广告效果好。
第二,信任成本高。模型厂商说自己多强多强,开发者半信半疑。匿名公测相当于"是骡子是马,拉出来遛遛",用真实数据说话。
第三,容错空间大。如果匿名上线反响不好,厂商可以不认领、不发布,就当是一次内部测试。反响好再认领,进可攻退可守。
但匿名公测不是万能药。它适合已经有一定技术积累、对自己模型有信心的厂商。如果模型本身不行,匿名上线只会暴露短板,到时候认领也不是、不认领也不是,更尴尬。
智谱这次玩得漂亮。牛来匿名六天,冲上榜首,再官宣认领,势能拉满。今晚开放权重,开发者可以下载自己玩,社区口碑还会进一步发酵。
接下来要看的是:牛来开源之后,能不能形成生态。模型开源只是第一步,有没有开发者愿意基于它做应用、做工具、做商业化,才是长期竞争力的关键。
DeepSeek就是例子。模型开源,社区活跃,应用层生态丰富,反过来又推动了模型的迭代。智谱能不能复制这个路径,要看它的运营能力和社区投入。
总之,牛来来了。不是吹出来的,是开发者一票一票投出来的。
#ai创造营##科技先锋官#
