Maximizing the value of your Claude Code sessions
Source: https://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions
Author: Lydia Hallie (Anthropic)
Published: 2026-08-14
Type: official blog / practitioner guide
中文导读
Anthropic 官方把 Claude Code 的 token 经济学掰开讲:agentic coding 让"每个任务有了自己的价格",同一任务的花费可以差近一倍,差在会话管理而非模型本身。
TL;DR 六条:任务间 /clear(避免无关上下文反复回传);开始前设好 model 和 effort(中途切换会 bust prompt cache);用 @-mention 附文件而不是点名让模型去找(省一次 Read/搜索);noisy 命令加 quiet flag 或丢给 subagent(命令输出会留在会话里直到结束);新会话跑一次 /context 看清 CLAUDE.md/MCP 工具加载了什么;离开键盘前 /compact(prompt cache 一小时过期,趁热摘要便宜得多)。
计费机制解释:input(prefill)与 output(decode)定价约 5 倍差;output 里大量是 thinking tokens,effort level 控制每轮思考量;缓存命中与否直接决定成本曲线。整篇是 vendor blog,但每条建议都有对应机制解释,可以直接进 CLAUDE.md 团队规范。
Key Takeaways
- 同一任务成本差异主要来自会话卫生,不是模型选择。
/clear(任务间)、/compact(休息前、cache 过期前)、/rewind(比 /compact 更省,只裁末尾)三件套。- 模型/effort 切换时机 = cache 失效时机;先用后切代价最小。
/context是 MCP 工具长尾加载的体检入口。- 命令输出与会话等价——noisy output 是隐性 token 黑洞。
Intake rationale
- Category: coding | Quality score: 4/5
- 官方一手、机制级解释、每条可直接落地;是当前 Claude Code 成本优化最系统的单篇参考。
Grounding
opencli web read 原文全文(2026-08-16);作者/日期来自页面元数据;六条 TL;DR 与机制解释均出自原文。