大数跨境

Claude Opus 5.5 浪费 token?这 4 步拦住它

Claude Opus 5.5 浪费 token?这 4 步拦住它 AI工程化
2026-09-25
8

有人在网络上分享了一个方法:四步阻止 Opus 5.5 在会话里浪费 token。

按顺序做,跑一个普通任务,然后查看 usage。

  1. 把 /effort 设为 medium

effort 是控制模型推理强度的参数。不用每次都拉满,改成 medium 后,简单任务上模型不会强行深度推理,token 消耗会降下来。

  1. 运行 /claude-api prompt-audit,应用给出的 diff

它会检查当前 prompt,给出一个 diff。应用后,每次请求的指令更精简,长期开销小很多。

  1. 在 CLAUDE.md(项目说明文件)里加规则:什么时候继续,什么时候停下来问

信息不足或需求有歧义时,模型倾向于自己猜,然后继续干,token 就这么烧掉的。在 CLAUDE.md 里写清楚触发“停止并提问”的条件,模型就有边界。

  1. 任务清单放进 TASKS.md,不要放在 scrollback 里

scrollback 是对话上下文。清单放在 scrollback,每次请求都占用上下文;放进独立文件,需要时读一次。改动很小,长期差别很大。

经过以上配置,完成后跑一次常规任务,检查 usage,就能看到差别。

关注公众号回复“进群”入群讨论

【声明】内容源于网络
0
0
AI工程化
专注于AI领域(大模型、MLOPS/LLMOPS 、AI应用开发、AI infra)前沿产品技术信息和实践经验分享。
内容 647
粉丝 0
AI工程化 专注于AI领域(大模型、MLOPS/LLMOPS 、AI应用开发、AI infra)前沿产品技术信息和实践经验分享。
总阅读5.5k
粉丝0
内容647