$浪潮信息(SZ000977)$ #AI算力# 蒸馏时代终结:AI行业的水变深了
9月2日,Anthropic干了件比发布新模型更大的事:封杀蒸馏。
Fable 5.1的API新增了一条铁律:模型返回给你的“思考块”(也就是AI答题前的完整推理过程),回传时必须和当初一字不差,改一个字就报错拒绝服务。而过去两年,无数小模型厂就是靠偷改上下文、诱导大模型吐出思考过程,再拿这些数据训练自家模型。DeepSeek们的低成本追赶路线,烧的就是这个燃料。
Anthropic为什么下这么重的手?两个原因。一个是钱:专业蒸馏团队用几千个假账号加自动化脚本,日夜不停地薅思考块,等于免费偷走了花上千万美元训练出来的核心资产。另一个更致命:蒸馏只偷得走智商,偷不走安全护栏。大模型的能力和价值观对齐是一体训练出来的,蒸馏出来的模型继承了解题能力,却没有继承“什么不能做”。相当于克隆了爱因斯坦的智商,没克隆他的道德感。这类高能力低护栏的模型流出去,是整个行业的安全噩梦。
新规的执行很讲究:8月31日之后的新账户先适用,老账户给缓冲期,但官方已明确未来覆盖所有账户。还有个意外收获:上下文一致性让提示词缓存可以高频命中,老实开发者的API成本和延迟反而大幅下降。
这件事对行业格局的影响,比它看起来大。
蒸馏时代,头部模型训练一次,全行业免费抄作业,模型差距永远只有三个月,小厂用几十分之一的成本就能逼平大厂。蒸馏被掐断,每家都得自己从头堆算力训练,能力差距会重新拉开到一两年。套壳赚快钱的路没了,竞争回归真实的算力、数据和算法。
对算力需求是双升:训练侧,各厂失去捷径,都要自研自练;推理侧,缓存降本带来token用量放量。行业总算力消耗不减反增。
映射到A股:卖算力的(服务器、存储、芯片)直接受益;有自有数据和自研能力的模型厂受益;纯套壳的应用包装商,利空出清。同一天Claude啃下费马大定理、OpenAI发布GPT-6,这一周发生的事连起来看,AI行业的水正在变深——会游泳的游得更远,裸泳的该上岸了。
发布于 广东
