有人在网络上分享了一个方法:四步阻止 Opus 5.5 在会话里浪费 token。
按顺序做,跑一个普通任务,然后查看 usage。
-
把 /effort 设为 medium
effort 是控制模型推理强度的参数。不用每次都拉满,改成 medium 后,简单任务上模型不会强行深度推理,token 消耗会降下来。
-
运行 /claude-api prompt-audit,应用给出的 diff
它会检查当前 prompt,给出一个 diff。应用后,每次请求的指令更精简,长期开销小很多。
-
在 CLAUDE.md(项目说明文件)里加规则:什么时候继续,什么时候停下来问
信息不足或需求有歧义时,模型倾向于自己猜,然后继续干,token 就这么烧掉的。在 CLAUDE.md 里写清楚触发“停止并提问”的条件,模型就有边界。
-
任务清单放进 TASKS.md,不要放在 scrollback 里
scrollback 是对话上下文。清单放在 scrollback,每次请求都占用上下文;放进独立文件,需要时读一次。改动很小,长期差别很大。
经过以上配置,完成后跑一次常规任务,检查 usage,就能看到差别。
关注公众号回复“进群”入群讨论

