「先卷智商,再卷单价」:OpenAI 给 GPT-5.6 Sol 砍价三成

| | 1 次浏览

大模型市场的竞争,正在从「谁的模型更聪明」延伸到「谁的账单更便宜」。8 月 22 日,OpenAI 宣布下调 GPT-5.6 Sol 的调用价格,API 与 Credit 渠道整体降幅超过 20%,其中输出 token 的降幅达到三分之一。这是近期少见的、直接落在旗舰模型上的降价动作。

事件要点

根据 IT 之家报道,本次调价的具体结构如下:

  • 标准档位:每百万 tokens 输入从 5 美元降至 4 美元,降 20%;输出从 30 美元降至 20 美元,降 33%。
  • 缓存:缓存读取从 0.5 美元降至 0.4 美元,缓存写入从 6.25 美元降至 5 美元。
  • 长上下文档位:输入从 10 美元降至 8 美元,输出从 45 美元降至 30 美元。

官方口径是「未来 3 个月内」执行上述价格,目前新价格已经在 API 上生效。一个值得注意的细节:输出的降价幅度明显大于输入,而长上下文的绝对降幅最大,每百万输出 tokens 直接便宜了 15 美元。

背景与影响

降价第一次打穿旗舰区间。 过去大模型厂商的降价多集中在轻量级或上一代模型,旗舰产品价格往往坚挺,因为它承载着「能力天花板」的定价权。GPT-5.6 Sol 这次输出降 33%,说明推理成本的下降与竞争压力,已经传导到了产品线的最顶层。

竞争压力是明牌。 就在前一天,Anthropic 的 IPO 招股书刚把「开源模型带来的利润率压力」写进风险因素,我们在早前的文章里已有讨论。当开源阵营的模型能力不断逼近闭源旗舰时,闭源厂商的定价空间被双向挤压,API 单价正在成为模型能力之外的第二战场。

对开发者而言,受益结构很有针对性:

  • 生成密集型应用受益最大。 代码生成、长文写作、多轮 Agent 工作流这类应用的输出 token 消耗远高于输入,输出降 33% 直接摊薄了它们的最大成本项。
  • 缓存降价利好长会话。 缓存读取降至 0.4 美元,高频复用 system prompt 与固定上下文的应用,边际成本进一步走低。
  • 长上下文门槛实质下降。 输出从 45 美元降到 30 美元,让「整份文档进、结构化内容出」这类重上下文场景的成本模型更可持续。

「限时降价」的玩法值得玩味。 与永久性调价不同,「未来 3 个月」的表述让这次动作带有促销色彩:既能刺激开发者在窗口期内把用量迁移过来,也为后续恢复原价或推出新定价结构留了余地。对个人开发者和小团队,这是可以立刻吃到的红利;但对重度依赖的团队来说,窗口期结束后的账单回弹,是必须提前算进架构决策里的变量。

简短点评

大模型单价一路下行已是行业共识,但每一次降价的结构都透露着厂商的策略意图。这次砍的是输出和长上下文,指向的显然是 Agent 与重度生成场景,恰恰是当前 AI 应用竞争最激烈的地带。

给开发者的短期建议很直接:审计自己的 token 消耗结构,看输出占比与缓存命中率,评估这波降价能省下多少真金白银。长期来看,把成本优化寄托在某家厂商的定价善意上并不可靠,随着价格战持续,多模型架构和 LLM 网关这类抽象层的价值只会越来越高。

降价本身不算新闻,降价的方式才是。

评论(0)

暂无评论,来写第一条吧。