张岱樾
26-09-25 11:28 微博认证:AI博主

CS329A Self-Improving AI Agents

斯坦福大学一门关于「能够通过与自身和环境的交互持续自我改进的 AI Agents」的课程。

讲师阵容
Azalia Mirhoseini:AlphaCode 与 LLM 大规模训练调度优化("Circuit Training")的核心人物,现为 Reflection AI 联合创始人
Aakanksha Chowdhery:PaLM 2 与 Gemma 的负责人,同样在 Reflection AI

嘉宾名单
Misha Laskin(Reflection AI CEO)
多位 Google DeepMind 研究员(Denny Zhou、Thang Luong、Melvin Johnson)、Physical Intelligence(Danny Driess,机器人)

课程主线:一条完整的自我改进技术栈
1. 推理时自我改进(Test-time)
2. 从反馈中学习(Feedback → Learning)
3. 开放式进化与搜索(Open-endedness)
4. 工程化与瓶颈(Agentic Engineering & Bottlenecks)

课程详细信息:
cs329a.stanford.edu/index.html

发布于 广东