大模型动态

GPT-5.6正式全球发布:结束12天受限预览,Codex并入ChatGPT

发布时间:2026年07月09日 14:00:00

经过12天美国政府安全审查与受限预览,OpenAI于7月9日正式向全球用户开放GPT-5.6系列模型Sol/Terra/Luna。Codex应用同步并入ChatGPT桌面端与Work智能体构成统一入口。Sol在Agents\' Last Exam上以53.6分超越Claude Fable 5达13.1分。


当地时间7月9日,OpenAI正式向全球用户开放GPT-5.6系列模型——Sol(旗舰)、Terra(均衡)、Luna(轻量)三款同时上线。这是自6月26日受限预览以来,经过12天政府审查后的全面解禁,也是OpenAI自GPT-5.5以来规模最大的一次产品更新。

核心性能突破

评测维度GPT-5.6 SolClaude Fable 5优势
Agents’ Last Exam53.640.5+13.1 分
Terminal-Bench 2.1 Ultra91.9%84.3%+7.6pp
Artificial Analysis 编码Agent指数8077.2+2.8 分
上下文窗口150万 Token100万+43%
推理成本约为 Fable 5 一半显著更低

Sol 在网络安全评测中得分 96.7%,ExploitBench 漏洞利用从 47.9% 跃升至 73.5%。

两大新模式

模式功能
Ultra 模式默认4个Agent并行,最多扩展至16个,并行协作完成复杂长程任务
Max 模式更长时间深度推理,提升复杂推理任务稳定性

Codex 并入 ChatGPT

独立运行近一年的 Codex 应用正式并入新版 ChatGPT 桌面应用,与全新 ChatGPT Work 智能体共同构成统一入口,整合对话、编码、长程任务执行。用户无需切换软件即可完成日常对话、代码开发和长时间运行的项目追踪。

定价与商业模式

模型输入输出定位
Sol$5$30旗舰,支持 Ultra/Max
Terra$2.50$15性价比杀器(仅 Fable 一半)
Luna$1$6轻量高并发

新增 Prompt Cache 缓存折扣:缓存写入按标准价 1.25 倍,读取享折扣,支持手动设置缓存断点——长期运行 Agent 成本可预测性大幅提升。

策略转变

从追求"每项基准测试都第一"转向"性能、成本、速度综合最优"。在 SWE-Bench Pro 和 FrontierMath 上 Sol 仍低于 Fable/Mythos,但在开发者最常用的编程和 Agent 场景上以更低成本压对手。