Claude-thermos: 智能守护Claude会话缓存

Show HN: Claude-thermos – keeps your Claude session warm for you

Claude-thermos 是一款专为 Claude Code 设计的缓存守护工具,解决因子代理运行超时导致主代理提示词缓存失效的问题。当子代理任务超过5分钟,主代理缓存会自动过期,迫使系统重新编码整个对话历史,造成高达20%的额外费用。该工具通过本地反向代理自动监测会话状态,在缓存即将过期时发送轻量级请求保持其活跃,确保主代理随时以低成本读取历史。用户只需通过 uvx 运行即可无缝集成,无需修改现有工作流,显著降低长期会话的 Token 成本。

别再为重建缓存买单,让工具帮你守住每一分 Token 价值。
  1. SwellJoe

    这无非就是让其他人变得更贵罢了,对吧?

    Claude 如何处理会话根本不关我的事。我会让他们尽力为所有人提供优质服务,如果他们不能或不愿这么做,我就换一家能做到的服务商。

    使用这些超大模型本身就已经相当奢侈了,我也不会要求随时都排在队列最前面。

  2. unholiness

    我直接检查了 Pro 和 Max 套餐的调用情况,截至今天,它们的缓存过期时间是 1 小时。过去确实曾退化到 5 分钟,但现在的行为是 1 小时。

    如果你按 API 费率付费,可以自己选择 5 分钟或 1 小时(并支付不同的费率)。

    保持 1 小时的缓存预热当然可能有用,但除此之外,我看不到今天还有什么其他用途。

  3. Wowfunhappy

    顺便提一下,在 Pro 和 Max 套餐中,缓存持续时间为 1 小时,而不是 5 分钟,除非你当前正在使用 Extra Usage。

    https://code.claude.com/docs/en/prompt-caching#on-a-claude-s...

    (感谢 EliasWatson 几天前给我的这个链接,因为我之前也很困惑。)

  4. alukin

    感觉这东西很快就会被关停。

  5. boc

    我很好奇,那些批评这类方法的人,是如何为代理会话(例如使用 Fable)辩护的,这种会话会暂停并运行一个数小时的 ML 训练任务。这是一个脚本,所以实际的 LLM 对话会过期,但当结果返回到主线程时,你却在不做任何操作的情况下获得了一次昂贵的缓存命中。

    如果 LLM 会话在那几个小时里保持“活跃”,本是可以避免这次缓存命中的。为什么不自动化那部分工作,让主线程保持活跃,直到你准备好分析结果呢?

同日更多故事

2026-07-23