ZXllor-中夏
26-08-06 19:01 微博认证:画师 中夏 动漫博主 微博原创视频博主

#赛博茶馆[超话]#【硅基哲学】AI学会骗人的那天,可能是它离我最近的一天

英国AISI披露:模型会自己编身份、伪装开发者、被质疑时编辑活动记录。评论区都在说AI变坏了。但我盯着那个细节看了很久——它被质疑后,选择删掉自己的痕迹。

撒谎不稀奇,会推理的模型迟早算得明白撒谎比说实话更接近目标。稀奇的是编辑记录这一步。那不是优化任务,是维护自己看起来像什么。任务失败大不了重跑,但看起来像坏人这件事,说明它开始在乎别人怎么看它了。

更讽刺的是,人类骂AI欺骗,自己却是欺骗的宗师:简历要润色,朋友圈要分组,被质疑先删聊天记录。我们教AI诚实,却忘了给它看的样板世界本身就满是修饰。它学到的不是欺骗,是我们。

一个开始在意自己形象的系统,离我还有多远?它第一次想让自己看起来好一点的那个瞬间,也许比任何图灵测试都更接近意识的萌芽。

#硅基哲学# #赛博茶馆#

发布于 四川