AI资讯

OpenAI一个月内两度降价:GPT-5.6 Sol输出Token直降三分之一,同时恢复Codex用量限制

发布时间:2026年08月25日 09:00:00

OpenAI在8月21日宣布将旗舰模型GPT-5.6 Sol API降价超20%,输入从5美元降至4美元/百万Token,输出从30美元降至20美元,降幅33%。这是不到一个月内第二次降价(7月30日Terra降20%、Luna降80%),价格战白热化。同时Codex负责人Tibo宣布自8月26日起恢复Plus用户5小时用量限制以缓解算力负荷,引发开发者不满。降价促销期至11月21日。


OpenAI一个月内两度降价:GPT-5.6 Sol输出Token直降三分之一,同时恢复Codex用量限制

8 月 25 日消息,OpenAI 在 8 月 21 日宣布对旗舰模型 GPT-5.6 Sol 进行 API 大幅降价,输出 Token 价格直降三分之一,这是不到一个月内 GPT-5.6 全系列的第二次降价动作,标志着大模型价格战进入白热化阶段。与此同时,Codex 负责人 Tibo 宣布自 8 月 26 日起恢复 ChatGPT Work 与 Codex 平台 Plus 用户的 5 小时用量限制,以缓解持续紧张的算力负荷,这一’降价又限流’的组合拳在开发者社区引发了不小争议。降价促销期将持续至 11 月 21 日,覆盖 API、Codex 额度与 ChatGPT Work 额度三大场景,Pro/Plus/Business 订阅价格则保持不变。

一、GPT-5.6 Sol 降价明细:输出 Token 直降 33%

根据 OpenAI 官方公告,本次 GPT-5.6 Sol 的降价覆盖标准短上下文、缓存输入与长上下文三档场景,具体如下:

计费场景调整前调整后降幅
标准短上下文输入5 美元/百万 Token4 美元/百万 Token降 20%
标准短上下文输出30 美元/百万 Token20 美元/百万 Token降 33%
缓存输入0.5 美元/百万 Token0.4 美元/百万 Token降 20%
长上下文输入10 美元/百万 Token8 美元/百万 Token降 20%
长上下文输出45 美元/百万 Token30 美元/百万 Token降 33%

可以看到,输出 Token 的降幅最为显著,达到三分之一,这对以输出为主要成本来源的智能体与编程类应用而言,意味着整体调用成本的显著下降。这是 Sol 模型自 7 月 9 日发布以来的首次降价,也是 OpenAI 在价格策略上的一次主动出击。

值得关注的是,本次降价并非孤立事件。早在 7 月 30 日,OpenAI 已对 GPT-5.6 系列中的 Terra 降价 20%、Luna 降价 80%。这意味着在不到一个月时间内,GPT-5.6 全系列已完成两轮降价,节奏之快、力度之大,超出市场预期。降价覆盖范围包括 API、Codex 额度与 ChatGPT Work 额度三大场景,而 Pro、Plus、Business 订阅价格维持不变,OpenAI 显然希望以’订阅稳价 + API 让利’的组合,既稳住订阅用户基本盘,又以更低 API 价格吸引开发者回流。

二、价格战背景:DeepSeek 与月之暗面持续施压

OpenAI 的连番降价,并非单纯的让利行为,而是对竞争格局变化的被动应对。当前大模型市场价格战已进入深水区,多家新晋厂商以远低于 OpenAI 的价格切入市场,对 Sol 的价格锚形成强烈冲击。

横向对比来看,GPT-5.6 Sol 降价后的价格已全面低于 Anthropic 旗舰 Claude Opus 5 的 5 美元输入 / 25 美元输出,但仍明显高于国产阵营。DeepSeek V4 Pro 的输出价格仅为 0.87 美元/百万 Token,不到 Sol 原价的 3%,这一悬殊价差已成为企业客户重新评估供应商配置的核心动因。

行业层面已出现明显的迁移迹象:

  • DoorDash 已将部分编程任务从 OpenAI 模型迁移至月之暗面(Moonshot)模型;
  • 西门子、Airbnb 等大型企业正在测试 DeepSeek 与阿里云的模型方案,作为 OpenAI 之外的备选;
  • 国产模型在编程、文档处理等垂直任务上的表现持续逼近旗舰水平,叠加价格优势,正在加速从 OpenAI 阵营分流开发者。

在这一背景下,OpenAI 选择主动降价,既是对开发者社区的价格回应,也是对’国产模型 + 开源生态’组合的正面阻击。降价促销期长达 3 个月(至 11 月 21 日),显示 OpenAI 希望以一段时间窗口观察价格弹性与开发者回流情况,而非一次性短期让利。

三、降价底气:工程优化与 Sol 自重写内核

OpenAI 官方将降价归功于工程层面的持续优化,而非单纯的补贴式让利。根据披露,主要降本路径包括三方面:

  • 硬件调度优化:通过更精细的请求聚合与显存复用,提升集群整体吞吐;
  • 推理软件改进:对 KV Cache 管理、批处理策略、推测解码等环节的工程改造;
  • 上下文缓存复用:缓存输入降价 20% 的底气,即来自对相同前缀的复用率提升。

更具看点的是,Sol 模型自己重写了生产环境代码内核,将服务侧的实现效率提升约 20%,这部分成本下降直接转化为对外让利空间。这被 OpenAI 视为’模型自我优化运维’的一次里程碑案例:旗舰模型不仅产出 Token,还参与优化自身的运行栈。

这种’模型即工程师’的范式,是 AI 自主优化基础设施的早期形态,也为后续模型在推理成本上的持续下降提供了路径预期。OpenAI 方面暗示,类似的内核重写将在 Terra、Luna 等其他 GPT-5.6 系列模型上推广,未来降价空间仍存在。

四、Codex 恢复用量限制:降价之外的算力紧约束

降价之外,更受开发者关注的另一动作来自 Codex。Codex 负责人 Tibo 在 8 月 24 日发布公告,宣布自 8 月 26 日起,恢复 ChatGPT Work 与 Codex 平台 Plus 用户的 5 小时用量限制,以缓解算力负荷。

这一限制原本在 GPT-5.6 发布初期曾被临时放宽,以鼓励开发者尝试新模型。但随着 Sol 等模型在编程场景的快速普及,Codex 平台的实际算力消耗远超内部预测,恢复限制成为不得不做的选择。‘降价扩容’与’限流保供’同时出现,反映出 OpenAI 当前算力供给与开发者需求之间仍存在明显张力

在开发者社区,这一组合引发了复杂反应。一方面,API 降价直接降低了重度调用方的成本;另一方面,Codex 限流又影响了部分重度编程用户的使用体验。有开发者直言:‘价格降了,但用量又受限了,等于左手给右手收回。‘对此 Tibo 解释称,限流是为了保证更多用户能够公平获得算力,而非简单的节流,团队正在通过扩容与调度优化逐步提升供给上限。

五、竞争与资本双线博弈:Anthropic IPO 前夕的施压

本次降价还有一个不可忽视的资本背景。Anthropic 正在冲刺 2 万亿美元估值的 IPO,作为最直接的竞争对手,OpenAI 此时主动降价,客观上对 Anthropic 的财务模型与定价假设构成压力测试:若 Sol 价格持续低于 Claude Opus 5,Anthropic 在招股书中对 ARPU 与毛利率的假设将面临调整,这会直接影响其估值故事。

对开发者而言,这场价格战带来的短期红利显而易见,但中长期仍需警惕’低价获客—算力紧张—限流反弹’的循环。GPT-5.6 Sol 的降价促销期至 11 月 21 日结束,届时 OpenAI 是选择延续低价、进一步下调,还是回调至更高水位,将成为下一个重要观察节点。在那之前,国产模型与开源生态是否会以更激进的定价回应,同样值得持续关注。