新智元
26-05-08 09:33 微博认证:新智元官方微博

Anthropic让AI学会做梦了!

Code with Claude旧金山开发者大会上,Anthropic为Claude托管智能体发布了三件套:Dreaming(记忆重组)、Outcomes(自动评分)、多智能体编排。法律AI公司Harvey用上这套组合拳后,任务完成率暴涨约6倍。
让Claude睡一觉,醒来自己变强
Dreaming是一个定时运行的异步任务,同时读取Agent现有记忆库和过去最多100个会话记录,自动合并重复项、替换过时条目、挖掘宏观规律,生成一份全新的重组记忆库。它永远不修改原始记忆库,开发者可以实时流式围观AI「做梦」过程,随时叫停,也可以通过instructions字段指定「做什么梦」。
Agent交完卷,还有评分官把关
Outcomes允许开发者写一套评分标准,由完全隔离的独立评估器对Agent输出打分,发现问题就让Agent重跑,开发者可设置最大迭代次数控制成本。内部测试显示,相比标准prompt循环,任务成功率最高提升10个百分点;docx文档任务成功率提高8.4%,pptx幻灯片提高10.1%。
一个Agent搞不定,组队上
多智能体编排让主Agent把大任务拆分后,派给搭载不同模型、工具的专家子Agent并行处理,成果汇总到主Agent全局上下文。大会现场演示了月球采矿无人机任务:6个着陆点初跑67%成功率,Dreaming跑一夜后全部修复,整体成功率达到100%。
算力自由
同日,Anthropic官宣与SpaceX达成协议,租下Colossus 1数据中心全部22万张GPU。随之而来的用户福利包括:Claude Code五小时使用限额即刻翻倍、取消高峰时段额度削减、Opus API速率限制大幅上涨。目前Dreaming以研究预览版上线,支持Opus 4.7和Sonnet 4.6,需申请权限;Outcomes和多Agent编排已进入公测。