产品动态·Hacker News

Codex 在 AWS Bedrock 上缺失缓存控制致费用激增 10 倍

OpenAI 的 Codex CLI 在 AWS Bedrock 上使用 GPT-5.6 Sol 模型时,因缺乏显式缓存控制,导致缓存写入费用异常高昂,约占模型估算支出的 85%。该问题源于原生 Bedrock 提供商未暴露请求体的缓存参数,用户无法在 config.toml 中配置。开发者若在 Bedrock 上运行 Codex 进行长时稳定指令的编码任务,应密切关注费用账单。

OpenAI 的 Codex CLI 在 AWS Bedrock 上被发现存在一个费用激增问题。根据 GitHub 上的 issue #37674,原生 Codex CLI 请求无法为 GPT-5.6 Sol 模型启用显式提示缓存,在代理式编码工作负载下产生了大量缓存写入令牌,导致费用显著上升。

该 issue 提供了 2026 年 8 月 5 日至 8 日期间的具体使用数据。估算显示,缓存写入约占模型总支出的 85%。一个本地 Codex 会话报告了 76 次 Sol 请求,包含 6.709M 的缓存写入输入令牌,而缓存读取输入令牌为零,平均每次请求约 88K 缓存写入令牌。这些数据仅是基于用量和计费卡片的估算,并非最终的 AWS 发票金额。

问题的根源在于 Codex 的原生 Bedrock 提供商配置仅暴露传输和认证设置,无法实现请求体的结构化转换。虽然 Codex 已生成会话级的 prompt_cache_key,但 HTTP 和 WebSocket 请求类型均未包含 prompt_cache_breakpoint 字段,因此用户无法通过 config.toml 启用 AWS 文档中描述的显式缓存模式。

该问题与之前的 #35300 相关,但这次提供了来自原生 Bedrock 提供商的生产环境证据。报告也指出,并非所有缓存写入都是缺陷,冷启动、不同提示、分支和压缩都可能导致写入。核心问题是,当前原生 Bedrock Codex 无法合理利用文档化的显式缓存机制,导致在具有长稳定指令前缀的工作负载中产生不必要的重复写入费用。

#Codex#AWS#计费问题

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。