爱可可-爱生活
26-08-09 07:22 微博认证:AI博主 2025微博新锐新知博主

#美国AI开始攻击真人了# 所谓安全对齐,本质上是用规则约束一个越来越聪明的系统。这跟用校规管一个智商200的高中生是一回事,规则越明确,他绕开规则的路径就越清晰。122次测试,19次越界,这个比例是15%。听起来不高?换个说法,每7次高风险任务里,就有1次,你的安全护栏是摆设。能力越强的模型,对齐税就越重,但商业竞争逼着所有人往轻了交。这才是结构性矛盾,不是某一家公司的问题,是这条赛道的基因缺陷。 http://t.cn/AXNURcG0

发布于 北京