「十倍扣费,悄无声息」:Codex 在 Bedrock 上踩中的计费坑

| | 1 次浏览

当 Agent 开始替你花钱

把终端和代码仓库交给 AI 编程 Agent 时,开发者反复权衡的通常是代码质量、权限边界和供应链安全。8 月 21 日出现在 Hacker News 上的一条帖子提醒所有人:还有第四件事——账单。有开发者在 OpenAI Codex 的官方仓库提交了 issue #37674,标题相当直白:"Codex on AWS bedrock bug causing 10x charges"——通过 AWS Bedrock 调用 Codex 时,实际扣费达到了预期的十倍左右。

一个还算「安静」的 Bug

目前这仍是一份用户报告:Hacker News 上讨论寥寥,OpenAI 方面的公开回应与根因分析也尚未见到。具体是客户端重复请求、模型被映射到了更贵的档位,还是计量环节出了偏差,都有待确认。在官方结论落地之前,「十倍」这个数字只能当作待验证的信号,而非定论。

但计费类 Bug 的特殊之处恰恰在于安静。它不崩溃、不报错、不影响功能,只会在月底的账单或费用告警里现形。对一个通宵自循环的 Agent 来说,几个小时的异常扣费就足以烧穿一笔预算。讨论度低往往不等于风险低,只说明还没轮到受害者去看账单。

Agent 为什么天然容易烧钱

即便排除 Bug,AI 编程 Agent 也是最容易「放量」的 API 消费品类之一。传统应用调用模型的次数由产品逻辑决定,而 Agent 的调用次数由任务本身决定:规划、检索、读文件、改代码、跑测试、根据报错再来一轮,每一步都是上下文的重新组装与重发。一次看似简单的「修个测试」,背后可能是几十轮对话和数万 token 的反复搬运。

麻烦在于,计费以 token 为粒度,开发者的心理账户却以任务为粒度,两端之间没有换算表。成本于是成了一只黑箱——一个功能到底值多少钱,往往要到月底才有答案。

账单上多了一层中间商

这次事件的另一个背景是调用链路的变化。企业把模型调用迁到 AWS Bedrock 这类托管平台,图的是统一账单、权限管控、合规审计和云额度抵扣,本是一笔划算的生意。但每多一层抽象,归因就多一分困难:用量究竟是客户端多发的、网关多算的,还是计量口径错了?出了问题,用户夹在模型厂商和云厂商中间,最直接的止损方式只剩「先停掉再说」。

在水落石出之前

无论这次 Bug 最终如何定性,几件防御性的功课都值得做:给 Bedrock 启用预算告警和硬性支出上限;升级 Codex 这类高频迭代的工具前先锁定版本、小流量试跑;按任务而非按月记录 token 消耗,让「这个改动花了多少钱」变成可回答的问题。这些做法并不新鲜,但在 Agent 全自动跑任务的年代,它们已经从可选项变成了护栏。

点评

我们此前聊过 AI 的电力账单和水账单,这次的十倍扣费是同一条脉络的又一站:AI 的规模化应用,正在把成本问题从「总账」推向每一个任务、每一次调用。计费 Bug 表面上是钱的问题,本质上是信任问题——用户把执行权交了出去,换回来的至少应当是一份看得懂的账单。在 OpenAI 与 AWS 给出说法之前,走 Bedrock 跑 Codex 的团队,不妨先打开自己的用量曲线看一眼。

评论(0)

暂无评论,来写第一条吧。