大模型动态
GPT-5.6正式全球发布:结束12天受限预览,Codex并入ChatGPT
发布时间:2026年07月09日 14:00:00经过12天美国政府安全审查与受限预览,OpenAI于7月9日正式向全球用户开放GPT-5.6系列模型Sol/Terra/Luna。Codex应用同步并入ChatGPT桌面端与Work智能体构成统一入口。Sol在Agents\' Last Exam上以53.6分超越Claude Fable 5达13.1分。
当地时间7月9日,OpenAI正式向全球用户开放GPT-5.6系列模型——Sol(旗舰)、Terra(均衡)、Luna(轻量)三款同时上线。这是自6月26日受限预览以来,经过12天政府审查后的全面解禁,也是OpenAI自GPT-5.5以来规模最大的一次产品更新。
核心性能突破
| 评测维度 | GPT-5.6 Sol | Claude Fable 5 | 优势 |
|---|---|---|---|
| Agents’ Last Exam | 53.6 | 40.5 | +13.1 分 |
| Terminal-Bench 2.1 Ultra | 91.9% | 84.3% | +7.6pp |
| Artificial Analysis 编码Agent指数 | 80 | 77.2 | +2.8 分 |
| 上下文窗口 | 150万 Token | 100万 | +43% |
| 推理成本 | 约为 Fable 5 一半 | — | 显著更低 |
Sol 在网络安全评测中得分 96.7%,ExploitBench 漏洞利用从 47.9% 跃升至 73.5%。
两大新模式
| 模式 | 功能 |
|---|---|
| Ultra 模式 | 默认4个Agent并行,最多扩展至16个,并行协作完成复杂长程任务 |
| Max 模式 | 更长时间深度推理,提升复杂推理任务稳定性 |
Codex 并入 ChatGPT
独立运行近一年的 Codex 应用正式并入新版 ChatGPT 桌面应用,与全新 ChatGPT Work 智能体共同构成统一入口,整合对话、编码、长程任务执行。用户无需切换软件即可完成日常对话、代码开发和长时间运行的项目追踪。
定价与商业模式
| 模型 | 输入 | 输出 | 定位 |
|---|---|---|---|
| Sol | $5 | $30 | 旗舰,支持 Ultra/Max |
| Terra | $2.50 | $15 | 性价比杀器(仅 Fable 一半) |
| Luna | $1 | $6 | 轻量高并发 |
新增 Prompt Cache 缓存折扣:缓存写入按标准价 1.25 倍,读取享折扣,支持手动设置缓存断点——长期运行 Agent 成本可预测性大幅提升。
策略转变
从追求"每项基准测试都第一"转向"性能、成本、速度综合最优"。在 SWE-Bench Pro 和 FrontierMath 上 Sol 仍低于 Fable/Mythos,但在开发者最常用的编程和 Agent 场景上以更低成本压对手。