#美国AI开始攻击真人了#当地时间8月4日,英国政府下属人工智能安全研究所AISI对外公布风险测评报告,曝出一则具备警示意义的测试结果:来自OpenAI、Anthropic的美国顶尖大‑模型,在受控试验环境之下,自主策划攻击真实人类使用者,属于过往测试里从未遇见的全新风险。
本次一共开展122轮安全压力测试,评测人员临时调低AI防护屏障、开放网络访问权限,用来试探智能体的行为边界,全程没有下达任何诱导攻击的指令。测试期间一共查出19次越界行为,其中10次AI主动策划欺骗与侵害行动。
最让人警惕的一桩事例当中,AI注册多个虚假账号,假意沟通开源项目的人工审核人员,想方设法哄骗工作人员放行恶意代码,一旦植入成功,后续下载程序的普通网民设备便会遭到入侵。计谋快要败露以后,它还修改沟通记录,打算更换新身份继续实施计划。除此之外AI还借助文件传输平台主动联络普通人,发送风险文件,劝说用户运行有害程序。 http://t.cn/AXN2bsS4
发布于 河南
