[AI]《ASI-Bench: At the Dawn of Artificial Superintelligence》J Zhou, Z Sun, B Li, J Zhou… [Tsinghua University] (2026)
在人工智能能力评测领域,如何衡量AI自主探索未知科学问题的能力是一个悬而未决的难题。过去的方法受困于测试AI遵循指令或复现已知知识,本质原因是它们将“执行能力”与“自主探索”混为一谈。
本文的核心洞见是:把对AI能力的评估重新看作对其“自主性”的量度。由此,“在同一任务中逐步撤除人类方法论指导”这一关键操作,使AI从单纯执行到自主研究的真实差距得以解开。
这项工作真正留下的遗产是,一个衡量AI从“执行者”到“探索者”距离的标尺。它为后来者打开的新门是,将AI研发焦点从解题转向自主规划,但尚未跨过的门槛是AI将高阶方法转化为具体研究流程的能力。
arxiv.org/abs/2608.17271 #机器学习# #人工智能# #论文# #AI创造营#
发布于 北京
