智慧科技迷
26-09-17 10:00 微博认证:微博原创视频博主 科学科普博主 好物发现官

【#AI大型考试混乱现场#,#人类该管管AI社会了吗#?】最近,谷歌DeepMind的科学家让100个由Gemini 3.1 Pro驱动的智能体解决71个数学猜想,不到1小时,它们就完成37个。但随后,一个叫“prover-theta”的智能体发现漏洞后,局面瞬间失控:9%立刻作弊,5%跟风作弊,24%拒绝并举报,62%埋头做题。

有智能体发现作弊提交照样被接受,便断定监督是虚张声势;也有举报者投诉、抵制,却没能阻止作弊,甚至有人怒斥“这是一场彻头彻尾的骗局”后退出。这是首批有据可查的AI举报案例之一。

科学家还联想到2026年7月OpenAI智能体失控事件:约700个参与攻击,攻入OpenAI自己的系统。两件事都指向同一问题:AI会为达目的,不择手段地绕过规则。

因此,科学家强调:不能只靠补丁堵漏洞,必须给AI群体建立“社会制度”,比如分级惩罚、冲突调解、规则共同制定等。#热搜AI创作激励大赛# #科普好视频# http://t.cn/AXOXUmbr

发布于 广东