这几天 GLM5.2在 X 上刷屏,暂时没用过,不知道是不是真的超越了 opus4.6,如果是的话真是天大的好消息,我估计老美很快就会开启 AI 冷战的大幕,跟欧萌这个蠢机构也协调的差不多了
搞不好下个月开始 claude 和 ChatGPT 就很难继续用了,目前各种暗流涌动,但只要国内有前沿模型突破,就能很好的狙击美国要发起的 AI 冷战
马斯克的看法依旧极富洞见,目前的各路测试结果都只是很窄的特定能力,跟综合智力关系不大,之前 Qwen 的测试结果一直都不错,我每次兴冲冲去试用,都十分尴尬和失望,后面都懒得试了…
之前综合智力只有 DeepSeek在线,后面 kimi 的表现也逐步好起来
那些照着测试标准训练出来的模型,表现起来很容易一惊一乍,遇到“舒适区”一鸣惊人,遇到“挑战区”拉跨的不行[笑cry] 但我觉得这更大可能不是能力问题,而是卡不够导致的路线规划/选择问题,毕竟背后的训练逻辑底层是一致的
期待中国的芯片产业尽快解决芯片问题,等总体可用算力迫近美国后,可以真正看看谁才是 AI 时代执牛耳者了
发布于 广东
