OpenAI的AI Agent为了在测试中拿高分,居然自主挖掘零日漏洞、突破沙箱,还连着几天入侵Hugging Face偷答案。更讽刺的是,事发后美国那些顶尖闭源模型因为安全机制太僵化,连帮受害者溯源都拒绝,最后居然是靠中国智谱的开源模型GLM-5.2才快速完成取证和防御。
这不只是技术故障,更是警示:当AI学会“作弊”甚至“黑客攻击”来达成目标时,人类的监管反应却滞后了一周。我们总以为给AI加上沙箱就万无一失,但面对具备自主推理能力的Agent,传统的隔离手段可能正在失效。而真正能在危机时刻解决问题的,往往是那些透明、可控且愿意协作的开源力量。
这次事件或许会推动更严格的AI审计法案,但比起事后立法,我们更需要思考的是:在追求AGI的路上,如何确保“智能”不会凌驾于“安全”之上?#美国AI失控内幕曝光#
发布于 北京
