如何最大化 Claude Code 会话价值
Maximizing the value of your Claude Code sessions

使用 Claude Code 时,输入和输出 Token 的成本差异巨大,而 Prompt caching 机制能显著降低重复请求的费用。文章深入解析了会话中的 Token 消耗逻辑,指出文件读取、命令输出等工具结果会持续占用上下文,导致后续轮次成本累积。通过合理使用 @-mention 引用文件、在会话初期调整模型与 effort 级别、避免中途切换模型或模式,以及利用 /rewind 替代 /compact 来保留缓存,可以有效控制成本。此外,长会话比短会话更昂贵,因为每一轮都要重读之前的历史。掌握这些技巧,能让你的 Claude Code 会话更高效、更经济。
一个典型的轮次是失衡的:输入数万 Token,输出仅数百 Token,但只有新增内容按全价计算。