马弘运
26-08-21 09:39 微博认证:数码测评师 资深摄影师 青年作家 科技博主

OpenAI这次开源的,我觉得可能比很多人想象中更重要。

它开源的不是Codex的“大脑”,而是Codex的“身体”。

8月19日,OpenAI正式把Codex背后的核心Agent Harness推向开放平台。简单理解,模型负责“想”,Harness负责让AI真正把事情干完:读取上下文、调用工具、运行代码、维护任务状态、申请权限、处理失败、继续执行。

以前大家比AI,最喜欢比模型参数、跑分、谁更聪明。

但到了Agent时代,我越来越觉得,模型可能只决定了AI的智商上限,Harness才决定它到底能不能干活。

OpenAI自己给了一个很夸张的数据:在ARC-AGI-3测试中,仅仅通过保留推理和上下文压缩等Harness层面的优化,GPT-5.6 Sol成绩就从13.3%提高到了38.3%,同时输出Token还减少到了原来的六分之一。

这就很有意思了。

同一个模型,换一套更好的“工作系统”,能力可以完全不是一个东西。

以前你想做一个AI Agent,要自己解决上下文、工具调用、任务状态、沙盒、权限审批、异常恢复等一堆东西。

现在OpenAI相当于说:

这套我们已经给Codex踩过无数坑的底层框架,你们直接拿去用。

而且它不是让所有人都去复制一个Codex。

恰恰相反。

OpenAI真正想做的是让Codex钻进各种软件里面。

比如公司的运维后台、客服系统、安全平台、研发工具、财务系统,甚至以后任何专业软件,都可以把Codex Harness嵌进去,让AI直接理解当前界面、读取业务数据、调用工具,然后在权限范围内完成任务。

所以我觉得这次最大的变化不是“Codex开源了”。

而是OpenAI开始把Codex从一个AI编程工具,往一个通用Agent基础设施推。

以前是:

人打开Codex,让AI帮自己工作。

以后可能变成:

你打开任何软件,背后都有一个Codex一样的Agent在帮你工作。

模型战争打到最后,可能大家会发现,真正值钱的不只是“谁的大模型最聪明”。

而是谁能够建立AI时代的操作系统、工具链和Agent生态。

模型是发动机,Harness是整辆车。

发动机大家迟早都会越来越强。

真正决定AI能不能进入现实世界的,可能恰恰是后面这一整套东西。

#CodexHarness开源##AI##科技先锋官#

发布于 四川