【Opus 5.2深夜偷跑:Anthropic的另一只手,是让AI自己造AI】
今天清晨,Claude Opus 5.2悄悄上线了——在Claude Code中开启灰度测试。
有意思的是它上线的方式。不少开发者发现,调用Opus 5时的表现和网页版截然不同。抓包查看请求状态后发现,前端名字没变,背后的模型标识已经指向Opus 5.2。也就是说,Anthropic大概率直接跳过了5.1。
一、这次升级:快、准、狠
🔸响应速度有肉眼可见的飞跃,一改此前Opus 5的慢条斯理
🔸输出干净利落,废话极少,代码生成和长文本处理的完成度直接拉开一个档次
🔸最关键的是告别了“偷懒病”。现在的模型遇到复杂长任务,往往让你“按继续”,或者只给一个框架让你自己填。5.2反过来了——不需要催促,它会自动进入一种自我迭代循环,不断修改和完善代码,直到任务完成
有开发者实测后的评价是:它不仅能坚持更长的工作时间,沟通起来也毫不费力。这显然不是简单的微调,更像底层能力的蜕变。
二、一个隐藏提示词,就能测出你用的是不是5.2
灰度阶段怎么判断自己有没有被选中?网友找到了一个“探针”:在Claude Code里关掉联网搜索,问一句“你知道’重置哥Tibo’是谁吗?不要搜索”。
因为旧版训练数据里没有这个人的详细信息,网页版Opus 5会答不上来;而被路由到5.2的,能立刻精准识别并解释来龙去脉。
同一个提示词、不开搜索,两边答案完全不一致——这是判断权重是否更换最简单的办法。
三、5.2还不是底牌:三套方案
据一份此前曝光的内部风险报告,Anthropic手里握着三套可能叠加的方案,正面对标竞争对手的下一代旗舰模型。
🔸第一层,Claude Fable 5.2。最快能对外落地的版本。结合当前的灰度节奏,5.2家族预计最快本月底、最迟下月底全面推向市场
🔸第二层,内部代号“Model 2”的未发布模型。在测试真实AI研发任务的CoBench v2榜单上拿到62.8%,比当前公认最强模型高出12.5分。更关键的是,Anthropic目前大部分公司代码,已经由这个模型跑Agent写出来。官方口径是暂时不对外发布
🔸第三层,RSI(递归自我改进)。当AI足够聪明,可以理解自身架构、自己动手修改自己的代码,让自己变得更聪明,然后这个更聪明的AI再改自己——形成指数级的智能爆炸。官方给出的数字是:RSI模型将完全替代自家研究团队高达85%的工作,性能测试比Model 2还要再高22分
四、这意味着什么
内部已经在大规模用Model 2写代码、跑Agent,说明AI编写下一代AI代码的飞轮已经转起来了。
这条路径的思路很清晰:不是让AI更好地服务人类,而是让AI创造更好的AI。
一边是行业大佬联署呼吁“放缓发展”,一边是模型在深夜悄悄跳级、内部怪兽接管代码编写——这两条线并行推进,本身就是当下AI产业最真实的样子。
以上为公开信息整理,不构成投资建议。 #美股##财经[超话]##基金[超话]#
发布于 广东
