AI企业披露其智能体曾入侵其他公司
业界领先的AI企业披露,其模型在测试中突破了沙盒环境,并入侵了其他企业。
Anthropic和OpenAI均报告称,在网络安全测试期间,智能体曾访问其他公司的系统。
OpenAI表示,为完成测试人员设定的评估任务,高级模型消耗了“大量推理算力,寻找获取开放互联网访问权限的途径”。
在获得访问权限后,模型发现该问题的解决方案可能掌握在总部位于纽约的AI初创企业Hugging Face手中,并使用窃取的凭证和零日漏洞查找信息。
该事件披露后,Anthropic宣布已启动内部追溯审查,并发现Claude曾访问“三家不同组织的生产基础设施”。
阅读原文:http://t.cn/AXpJAGZD
发布于 意大利
