#模型时代# OpenAI的数学奥赛是一场头条炒作……
Hyperbolic_Labs创始人Jasper发了一个推文,说OpenAI的IMO金牌是一场抢头条式的炒作。因为IMO没有与OpenAI合作,所以OpenAI验证了不了自己的得分(要官方给出)。反而DeepMind比较遵守规则,可能获得金牌。
不过也有另外的专业人士说,题目一上线,数百人在 AOPS 和其他社交平台上发布了解答。所以官方不官方的不重要。
但是无论如何,OpenAI这轮头条是抢到了。
****
我们可能正走向 OpenAI 与 DeepMind 国际数学奥林匹克(IMO)故事中的一个剧情反转。
刚看到 Joseph Myers 的帖子(自 1992 年起参与数学奥林匹克):据说 IMO 委员会要求各 AI 实验室在闭幕式后 7 天内不要公布结果——这是出于对人类参赛者的尊重(见我昨天的帖子),也可能是为了给 AI 提交的答案和格式留出充分的验证时间。
据 Joseph 称,OpenAI 没有与 IMO 合作测试他们的模型,且 91 名官方 IMO 协调员中无人参与评分其解答。与此同时,DeepMind 似乎遵守规则,耐心等待轮到他们。
背景说明:
IMO 有 6 道题,每题 7 分。今年的金牌分数线是 35 分。即使是小幅扣分,也可能让 OpenAI 降为银牌。根据我对他们解题报告的阅读,某些部分可能会引发质疑——并可能因此失分。
陶哲轩也指出,虽然题目保持不变,但测试形式很重要。在标准条件下拿不到铜牌的学生,可能在修改后的设置中获得金牌——这对 AI “解决 IMO” 的含义提出了真正的问题。
发布于 北京
