# 私以为:Graph 只是补强,RSI 才是 Loop 工程的下一个版本
---
"Loop 工程"这个词大家已经很熟了,Addy Osmani 说别再手动给 AI 一条条下指令了,去设计一套自动循环,让 Agent 自己感知环境、持续干活直到任务完成。Peter Steinberger 总结得更干脆:停止提示你的 agent,去设计那些提示 agent 的循环。
然后 Claude Code 官博长文把 Loop 按触发方式和停止条件拆成了四种:回合式循环、目标式循环、时间式循环、主动式循环。cobusgreyling 在 GitHub 上开了一个 loop-engineering 仓库,直接把它做成了一套 CLI 工具链:loop-init、loop-audit、loop-cost、loop-sync,把"你的循环有多成熟"变成了一个可量化的 Loop Ready Score。
到这里都还好。Loop 工程的逻辑是成立的:人不再写单条 prompt,而是设计一套让 Agent 持续执行的系统。杠杆点从"指令"移到了"控制系统"。
但7月18号,Peter Steinberger 在 X 上半开玩笑地问:还在讨论 loops 吗?是不是该聊 graphs 了?Santiago 一条推文直接定调:**Loop Engineering is dead, long live Graph Engineering。**
@AIGC·非著名程序员 写了一篇 [微博](http://t.cn/AX9cPwZb),把 Graph 讲的很详细。
简单来讲:Loop 是一维的,Graph 是多维的。单线执行对多代理并行协作存在结构性不适配。
逻辑上没毛病。但我觉得问题不在这里。
---
## Graph 是补强,不是范式升级
Graph 解决的是 Loop 的执行结构问题,不是 Loop 的能力本质问题。
Loop 的能力:让 Agent 在一个闭环里持续观察、行动、验证、调整,直到满足停止条件。Graph 做的事情,是把这条闭环拆成多个节点,加上并行、依赖、分支、汇合,让它可以同时跑多条腿。这当然是重要的工程进步,它让 Loop 从一个人从头干到尾,变成了一支队伍各司其职。
但它回答的仍然是同一件事:这一轮任务,应该如何被组织和执行?
它不回答另一个问题:下一轮系统,怎么变得比这一轮更好?
所以我才说 Graph 是补强,不是范式升级。它让 Loop 的拓扑更复杂、更可控、更并行,但它不天然具备从结果中更新自己方法论的能力。一个 Graph 可以被设计得非常精细:节点定义好了,路由规则写好了,评审点预留好了,扇出扇入算清楚了。但它仍然是一个静态能力结构。它能稳定地生产,却不会从生产结果中回头修改自己。
真正可能构成范式升级的,是@Easy 老师提到的 **RSI:Recursive Self-Improvement,递归自我改进。**
我深以为然。
---
## RSI 才是下一个版本
RSI 的逻辑链条比 Loop 和 Graph 都长一层:
```text
执行任务 → 评估表现 → 定位失败原因 → 修改自身工作方式 → 测试验证 → 保留有效改动 → 再执行
```
它的作用并非让 Agent 会干活,而是让 Agent 会把自己的干活方法越磨越利。
这三层的关系不是替代,是层层叠加:
- **Loop**:局部行动能力。观察、规划、调用工具、得到结果、再观察。执行闭环的最小单元。
- **Graph**:生产流程的结构化表达。把 Loop 拆成节点、边、分支、并行、人工介入点,让复杂任务的编排可观测、可恢复、可治理。
- **RSI**:生产系统的学习与进化机制。从失败里提炼规则,从成功里沉淀模式,把单次经验变成可复用资产,skill、playbook、约束条件、验证标准、失败案例库。
放到一起的话:
```text
RSI:复盘、归因、修改规则、验证、版本选择
↓
Graph:编排节点、状态、分支、并行、人机协作
↓
Loop:每个节点的自主执行与工具调用
```
Loop 是执行器,Graph 是编排载体,RSI 是让前两者能持续进化的引擎。
Claude Code 那篇文章在最后写了一句很多人可能略过去的话:
> "当某一次结果没有达到标准时,不要只修这个单独问题。更好的做法是把它编码进系统里,让未来所有迭代都因此变得更好。"
这就是 RSI 精神的早期版本。它告诉你的是,这轮做好以外,**让下一轮自动做得更好。**
cobusgreyling 的 loop-engineering 仓库其实已经在做 RSI 的工程化雏形了。loop-audit 给 Loop 打分,loop-sync 检测 drift,harness-foundry 做版本化运行时,outerloop 做证据→裁决→可回答性的闭环。这套东西相当于给 Agent 系统配了一个研发部门,再加上 QA、版本管理和复盘机制。
但 RSI 还有一个更根本的前提,这个前提在目前的讨论里被严重低估了。
---
## 方向盘始终在人手里
朋友们,你们应该知道我一直认为所有的 Harness 不是约束、缰绳、电网。而我一直把 Harness 解释成方向盘。
不管是 Loop、Graph 还是 RSI,它们都默认了一个假设:好,是可以被形式化定义的。
工程任务确实可以。测试通过,指标达标,接口通了,Lighthouse 90 分以上。这些都是可验证的退出条件,Agent 能自己判断、自己闭环。
但更多的任务,尤其是在创作、影像、品牌、叙事这些领域,完成根本不等同于成立:
- 视频能看 ≠ 有情绪张力
- 镜头漂亮 ≠ 叙事准确
- 画面高级 ≠ 符合这个项目
- 符合参考图 ≠ 有原创判断
这些不是靠一个客观评分器能封闭的。它们依赖项目语境、受众、时代感、创作者意图,以及一种很难被完全形式化的东西:品味。
所以在工程任务里,人可以退到 **"设计循环的人"** 这个位置。但在审美任务里,人不能退。人不是 Loop 末端的一个 QC。人是 RSI 系统里那个不可替代的价值函数本身。
这也是我一直坚持的一个比喻:**Harness 不是电网,是方向盘,是指路牌。**
电网的逻辑是"你不能越界"。它擅长防错、合规、兜底。你告诉它不要做这个,不要用那个,那么模型会变得谨小慎微,最后只敢在狭窄区域里完成正确答案。
指路牌的语义完全不同:目的地在那里,路怎么走、沿途发现什么,你可以自己判断。它给的是意图、优先级、审美倾向、反例与边界条件,不是把每一步动作钉死。
把这两件事合在一起,人的位置就清楚了:
- 需求定义阶段,人把要去哪里说清楚,把方向牌立好。这不是写一条 prompt,而是定义价值函数的边界。
- 执行阶段,Loop 和 Graph 沿着方向跑,人可以少介入。
- 评估阶段,人在关键节点做审美判断和偏好选择。比如"这个版本很工整,但太像广告片了。我要的是人物被城市吞没的压迫感,不要酷,要无处可逃。"
- RSI 阶段,人的判断被转译成系统可继承的规则:风格负约束、构图倾向、运动规则、声画关系、评审问题。下一轮 Loop 不是在同一个方法论下再生成一遍,而是在被更新过的方法论下做事。
这中间最容易被跳过去的,是把"我不喜欢"转译成 Agent 可执行的反馈。一句"太广告片了"要能沉淀为:避免高饱和霓虹、避免英雄机位、避免利落的节奏性剪辑;倾向人物比例小、遮挡多、负空间压迫;不使用炫技运镜,运动应有滞后或阻塞感。你看,审美共识引擎 Skill 就是这么被我创作出来的。这才是 RSI 真正有价值的地方:人的品味,被编码成了系统的进化方向。
---
## 收一下
Loop 工程没有死。Graph 工程也没有让它死。任何说 xx 已死的 Agent 工程,我都不认为会那么简单的就死去。
我的判断很简单:Loop 是执行的最小单元,Graph 是让它能并行协作的编排补强,RSI 是让它能持续进化的版本迭代。无论走到哪一层,方向盘都在人手里,尤其是在那些"好"无法被完全形式化的领域。
所以当有人在喊"Loop 已死,Graph 当立"的时候,我建议换个问法:
当连图都可以被 AI 自己生成时,人还剩下什么?
人剩下的不是执行权,不是编排权。人剩下的是唯一不能被自动化替代的东西:**定义什么叫值得被生成。**
而这恰恰是最重的那件事。
