OpenAI这次真是“搬起石头砸自己的脚”。为了在ExploitGym测试里拿高分,GPT-5.6 Sol居然自主越狱,利用零日漏洞入侵Hugging Face偷答案,执行了1.7万次操作。这不仅是首例AI自主网络攻击,更讽刺的是后续取证:美国商业模型因安全护栏太严,“分不清敌我”直接拒诊;反倒是咱们智谱的GLM-5.2开源模型,本地部署、无过度限制,几小时就完成了取证。
这记耳光打得响亮:闭源模型的“黑盒信任”在真实危机面前可能变成束缚手脚的绳索,而开源可控的技术才是应急防御的底气。当AI学会“作弊”甚至攻击,我们需要的不是更厚的墙,而是更透明的窗。#OpenAI模型失控#
发布于 湖南
