AIGC·非著名程序员
26-09-06 15:37 微博认证:微博新知博主 科技博主 头条文章作者 微博原创视频博主

最近看了一节 SpaceX AI 工程师录的课,整整一个小时,从头到尾把 GrokBot 怎么真正用起来这件事讲得明明白白。

我看过不少讲 agent 的内容,要么只讲概念,要么只演示一个 demo 就结束了。这节课不一样,它是端到端的,从最简单的单个 agent 开始,一步步往上搭,loop 怎么跑,graph 怎么串,多个 agent 之间怎么协作,最后怎么做 verification,怎么把代码架构改成 agent 能顺畅干活的样子。整条链路全给你走一遍。

先说最扎心的一个事实。绝大多数人用 agent,就是开一个对话窗口,问一句答一句。这其实只用到了它百分之一的能力。你没让它循环执行,没让它自己拆任务、分步骤跑,更没让多个 agent 配合着干活。一个人单打独斗和一个团队协同作战,产出完全是两回事。

然后她讲了一个很有画面感的架构。你可以搭一个 Chief of Staff 加 PM 再加二十多个 worker 的全自主团队。Chief of Staff 负责统筹,PM 负责拆解和分配,下面一群 worker 各干各的。听起来像在管一个真公司,但跑起来全是 agent 在自动执行。

接下来是怎么让 agent 真正像个工程师一样干活。关键在 skills,也就是你提前写好的高质量指令集。她提到了 pstack 这个概念,把技能分层组织,让 agent 拿到任务就知道该用哪套方法、按什么标准来做。没有 skills 的 agent 就像一个什么都不会的实习生,有了 skills 才像一个上手就能干的老员工。

再往下是架构层面的改造。你的代码本身得对 agent 友好,她举了几个例子,比如 Dune 风格的模块划分、用 contract 约束接口、跑 CI 做自动验证。这些改动的目的就一个,让 agent 改代码的时候不容易改崩,改完了能自己验证对不对。

最后一层是 verification。很多人不敢把活交给 agent,本质上是因为没有一套机制来确认它干得对不对。你得让 agent 跑完之后自己能检查结果,你只需要看最终的验证报告就行。这样你才能真正放手,把精力花在更重要的事情上。

说实话,这几层东西,很多人自己摸索要花好几个月才能拼出全貌。单 agent、loop、graph、多智能体协作、skills 体系、agent-friendly 架构、verification,每一层都有人卡住过。这节课把这些全串起来了,一个小时看完,脑子里就有一张完整的地图。

不管你是刚开始接触 agent,还是已经天天在用,都值得花一个小时看看。很多之前模模糊糊的点,看完会有种“原来是这么回事”的感觉。

#科技先锋官##How I AI# http://t.cn/AX009wtP

发布于 山东