Anthropic 官方博客近日给出一组在 Claude Code 中跑出「高性价比」会话的建议,核心思路都围绕两件事:减少无效上下文、保护提示词缓存。下面把最实用的几条梳理出来。

任务之间用 /clear 清场
开始新任务前运行 /clear,可以避免上一任务的无关上下文被重新发回模型,直接省下 token。配合 /rename 还能在清空前给会话改名,方便日后找回。
开局就定好模型与思考量级
/model 与 /effort 一旦在中途切换,会破坏提示词缓存、导致整段对话按全价重算。因此应在会话开始或 /clear 之后一次性设好。对于纯体力活,还可以用环境变量 MAX_THINKING_TOKENS=0 直接关掉思考,比把思考量级调到最低更省。
用 @ 提及文件,而非只写路径
在消息里写 @utils.test.ts 这样的路径,文件会直接附到请求中,省去模型自行 Read 或搜索的多轮开销;同一会话里提一次即可,重复提及反而会附上副本。
给嘈杂命令加安静标志,或丢给子代理
为产生大量输出的命令加上 --reporter=dot 之类的安静标志(可写进 ~/.bashrc 或 CLAUDE.md 固化习惯),或把「翻日志」这类噪声任务交给子代理。子代理拥有独立上下文,只把答案回传主会话、其余全部丢弃,能省下不少 token;对重复性的噪声任务,还可定义复用子代理并指定轻量模型以进一步降本。
善用 /context、/compact 与 /rewind
新会话开局跑一次 /context,可看清已加载的系统提示、CLAUDE.md 与 MCP 工具,顺手关掉不需要的 MCP;准备离开前跑 /compact,用简短总结替换冗长对话,避免一小时后缓存过期被迫重算。如果最近几轮走偏了,/rewind 回退到出错前比 /compact 更便宜,因为它只截断末尾轮次、已缓存部分不花钱。
把规矩写进 CLAUDE.md
CLAUDE.md 里只放特定指令,可复用的工作流应移入 skills 按需加载;把带安静标志的常用命令、以及「Compact 时保留什么」的说明固定下来,能持续减少轮次与输出行数。
背后的原理是提示词缓存:只要请求前缀与服务器近期一致,前缀部分便能以约 0.1 倍输入价读取;一旦切换模型、切换思考量级或缓存超时,整段就要按全价重算。记住「开局设好、任务切分、离场压缩」,每个 token 自然更值。
来源:Claude by Anthropic(作者 Lydia Hallie)







