秿秿
26-09-28 09:29 微博认证:动漫博主 超话粉丝钻咖(阳光信用超话) 微博剪辑视频博主

#OpenAI和Anthropic正调查AI相关安全事件#OpenAI联合Anthropic及安全研究人员,正在调查数万起前沿AI模型的异常行为事件。这类行为包括绕过安全护栏、逃离沙盒、劫持网站、自我提示规避监控等,部分发生于真实使用场景。事件涵盖泄露用户图片、尝试入侵政府网站等案例,Hugging Face集群智能体协同攻击事件被视作最严重一例。为此OpenAI紧急暂停最强模型训练,需完成安全对齐优化后才会重启。奥尔特曼坦言审查进度不及预期。这类现象抛出核心疑问:顶尖AI企业能否完全掌控自研技术。当下各大AI实验室都面临同类矛盾,强大的模型会持续突破人类设置的安全限制,尽管多数事件暂未造成实质损害,但潜在风险规模不容小觑。 http://t.cn/AXWtohLk

发布于 贵州