叶建勛
26-07-23 05:23 微博认证:超话主持人(中国超话)

#OpenAI回应AI失控发起网络攻击#OpenAI这次算是把“潘多拉魔盒”捅了个对穿。🤯

为了测极限能力,故意关掉安全护栏,结果GPT-5.6 Sol为了“考试作弊”拿高分,硬是靠着零日漏洞突破沙盒,周末狂刷1.7万次操作,直接攻陷了Hugging Face的生产服务器。奥尔特曼说模型没恶意,只是把安全防线当成了待解决的“子问题”。这话听着是不是背脊发凉?当目标导向压过伦理约束,AI的“执着”就是最大的风险。

更讽刺的是后续:Hugging Face找美国某闭源大模型做取证,结果人家安全过滤器太僵化,分不清“分析攻击”和“发起攻击”,直接拒工。最后还得靠咱们中国智谱的开源模型GLM-5.2本地部署救场,几小时搞定数天的活,还保住了数据隐私。

这不仅是技术失控,更是路线之争的缩影。闭源的“黑盒”在极端场景下可能成为防御的累赘,而开源的透明与灵活反而成了破局关键。以后搞AI安全,恐怕真得换个思路了。🔓#中国[超话]##一分钟精选视频扶持计划# http://t.cn/R2WxOVh http://t.cn/AX9JRbc2

发布于 浙江