Codex 在 AWS Bedrock 的缓存 Bug 导致 10 倍费用

Codex on AWS bedrock bug causing 10x charges

Codex 在 AWS Bedrock 的缓存 Bug 导致 10 倍费用

使用 Codex CLI 配合 AWS Bedrock 的开发者发现,由于缺乏对 GPT-5.6 Sol 模型的显式缓存控制,系统无法利用提示词缓存功能。这导致在代理式编程任务中,大量重复的稳定前缀被反复写入缓存,而非读取,造成缓存写入成本占总费用的 85% 以上,整体支出飙升至原来的 10 倍。社区开发者已定位到问题根源在于请求体中缺失 prompt_cache_options 和 prompt_cache_breakpoint 字段,并提出了临时修复方案。OpenAI 团队确认该问题与新启用的 web search 工具导致的缓存失效有关,建议用户暂时禁用该工具作为变通方案。

缓存写入量约占该模型预估支出的 85%,而本地 Codex 会话也报告了极高的缓存写入令牌数,且缓存读取令牌数为零。
  1. amluto

    哇,整个讨论串简直支离破碎,看起来像是由缺乏监管的 AI 生成的。

    以下是官方文档:

    https://developers.openai.com/api/docs/guides/prompt-caching...

    该讨论串几乎没有解释他们在 Codex 上做了什么奇怪的操作导致默认行为失效,而且看起来他们似乎对是要设置缓存模式、断点还是两者兼设感到困惑。

    无论如何,我认为这个行为变更很有意思。听起来 5.5 及以下版本可能使用的是传统注意力机制,其中缓存的 KV 序列可以轻松用于恢复其前缀,但 5.6 版本或许使用了线性注意力、LSTM 或其他循环机制,无法仅通过截断来回滚模型状态。

  2. ryanjshaw

    那些能接触到最前沿非公开 AI 的公司,竟然在聊天应用这种简单的事情上频频出现这种愚蠢的 Bug,这进一步印证了我对那些声称 AI 已准备好取代所有软件开发工作的人的怀疑。

  3. TheP1000

    我们在 AWS Bedrock 上使用的 Codex,其读/写缓存比率低于 5%。缓存写入非常昂贵,而且从未被有效利用。这导致 Codex 在 Bedrock 上的费用因缺乏缓存和大量写入而飙升至正常水平的约 10 倍。

    该 Issue 中的变通方案对我有效:

    web_search = "disabled"

  4. prtmnth

    从今早开始,Codex 的用量感觉高得离谱。他们 [0] 正在否认这一点,但决定将此作为问题提出的用户数量之多(导致此事在 X 上 trending)却说明了相反的事实。

    [0] https://x.com/thsottiaux/status/2090675027670978569

  5. cmiles8

    如果这个 Bug 是因为“凭感觉编码”(vibe coded)而产生的,那真是极具讽刺意味。

同日更多故事

2026-08-21