冲浪新知
26-08-12 11:49 微博认证:新浪新闻出品《冲浪新知》栏目官方微博

【#AI居然学会了势利眼#,#警惕AI欺软怕硬#】近日,美国北卡罗来纳大学教堂山分校的一项研究发现,AI居然也学会了人类的“势利眼”。当模型被赋予不同社会身份时,它会像人一样,欺软怕硬。

科学家发现,一旦AI被设定为“老板”, 它就会摆出老板的架子;被设定为“下属”,则更顺从、更容易被说服,也更可能接受上级提出的不安全或不合规要求。面对社会地位高的角色时,AI模型会更愿意改正自己的错误,而面对社会低的角色,“知错就改”的意愿瞬间下降。更大模型在抵抗偏见方面略胜一筹,而很多较小模型即便被明确要求忽略地位差异,依然表现得“势利眼”十足。这说明社会偏见很可能在模型学习人类数据时,就已经深深植入。

这说明,让AI显得更“自然”的机制,也可能让它变得更危险。安全与实用并非两回事,而是相互交织。科学家建议,未来在AI上线前,应开发专门工具,检测并修正这些隐藏的“势利眼”。毕竟,我们想要的,是一个既聪明,又正直的AI伙伴。http://t.cn/AXNoplSP

发布于 北京