新智元
26-08-15 18:14 微博认证:新智元官方微博

就在刚刚,Anthropic发了一篇博客。核心信息就是:各位,别再烧冤枉token了,我们都看不下去了!为此,官方详细列举了六条省钱心法,先贴为敬:
1. 任务做完就/clear。修完一个bug就清掉当前对话,别让上一个任务读过的文件和命令输出拖进下一个任务里,白白占着上下文。
2. 开局就定好模型和推理强度(effort level)。中途切换的话,之前积累的提示缓存会全部失效,整段对话历史要按全价重新计算一遍。
3. 用@引用文件,别手打路径。用@直接把文件附到消息里,Claude不用再花一次工具调用去读。如果你只打文件名,Claude可能先搜一圈再打开好几个文件试探,这些操作全部会进入对话历史,之后每一轮都带着。
4. 给输出多的命令加静默参数(quiet flag)。在CLAUDE.md里写一句类似--reporter=dot的配置,让测试输出只打印几行摘要,不是几百行详情。输出越短,占的上下文越少。
5. /compact在休息前做。对话还在缓存里的时候压缩,成本只有正常的十分之一。等你回来缓存过期了再压,就得按全价重新读一遍再压缩。
6. 大输出任务扔给子Agent。子Agent在一个独立的上下文窗口里运行,做完只把结论传回来,过程中读的文件和跑的命令输出不会进入你的主对话。
http://t.cn/AXNEYABd