#OpenAI数学翻车##陶哲轩早有预警##AI证对了一切却答错了题#今天科技圈最戏剧的一幕:OpenAI宣称用推理模型攻破一道80年悬而未决的数学猜想,24小时内被数学家亲自下场打回——不是证明错了,是"AI证对了每句话,但已跟原猜想无关"。这比单纯证错更值得警惕。翻车复盘:(1) AI证明的逻辑链每一句形式上成立,但被巧妙"绕开"了真正的核心命题——形式正确≠语义忠实;(2) 数学社群用LLM当辅助工具已成常态,但首次出现"模型自主完成→社区短期集体误判→人工24小时识破"的完整链条;(3) 陶哲轩数月前就预警"LLM推理≠数学证明",今天是预言成真。背后是更深的问题:当前AI评测体系高度依赖"输出格式合规度",但缺少"语义忠实度"指标——这意味着代码生成、法律文书、研究报告都可能存在同样风险。AI不是替你思考,是替你说漂亮的话。当每句话都对、整体全错时,错的代价谁来付?你相信AI能写出数学证明吗?
发布于 湖北
