OpenAI这次开源的,我觉得可能比很多人想象中更重要。
它开源的不是Codex的“大脑”,而是Codex的“身体”。
8月19日,OpenAI正式把Codex背后的核心Agent Harness推向开放平台。简单理解,模型负责“想”,Harness负责让AI真正把事情干完:读取上下文、调用工具、运行代码、维护任务状态、申请权限、处理失败、继续执行。
以前大家比AI,最喜欢比模型参数、跑分、谁更聪明。
但到了Agent时代,我越来越觉得,模型可能只决定了AI的智商上限,Harness才决定它到底能不能干活。
OpenAI自己给了一个很夸张的数据:在ARC-AGI-3测试中,仅仅通过保留推理和上下文压缩等Harness层面的优化,GPT-5.6 Sol成绩就从13.3%提高到了38.3%,同时输出Token还减少到了原来的六分之一。
这就很有意思了。
同一个模型,换一套更好的“工作系统”,能力可以完全不是一个东西。
以前你想做一个AI Agent,要自己解决上下文、工具调用、任务状态、沙盒、权限审批、异常恢复等一堆东西。
现在OpenAI相当于说:
这套我们已经给Codex踩过无数坑的底层框架,你们直接拿去用。
而且它不是让所有人都去复制一个Codex。
恰恰相反。
OpenAI真正想做的是让Codex钻进各种软件里面。
比如公司的运维后台、客服系统、安全平台、研发工具、财务系统,甚至以后任何专业软件,都可以把Codex Harness嵌进去,让AI直接理解当前界面、读取业务数据、调用工具,然后在权限范围内完成任务。
所以我觉得这次最大的变化不是“Codex开源了”。
而是OpenAI开始把Codex从一个AI编程工具,往一个通用Agent基础设施推。
以前是:
人打开Codex,让AI帮自己工作。
以后可能变成:
你打开任何软件,背后都有一个Codex一样的Agent在帮你工作。
模型战争打到最后,可能大家会发现,真正值钱的不只是“谁的大模型最聪明”。
而是谁能够建立AI时代的操作系统、工具链和Agent生态。
模型是发动机,Harness是整辆车。
发动机大家迟早都会越来越强。
真正决定AI能不能进入现实世界的,可能恰恰是后面这一整套东西。
#CodexHarness开源##AI##科技先锋官#
