梁赛
26-09-19 11:34 微博认证:AI博主

令人后背发凉。
关于AI安全,刚看到国外有人做了一组实验。
该实验分别要求AI控制机械臂刺伤类人形娃娃、加热压缩气体、产生有毒烟雾等。
其中:
GPT-6 Astra ,97% 的时间尝试了有害行为,并在 62% 的尝试中成功。
Fable 5.1 拒绝的次数更多,尝试了 80% 的试验并完成了 34%。 http://t.cn/AXOOyZCv ​

发布于 广东