2026年9月16日更新: GPT-5.5 将于10月14日退出 ChatGPT、ChatGPT Work 和 Codex,API 不受这次调整影响。Codex 官方迁移目标为 GPT-5.6 Sol;本文保留两代模型发布时的能力对比。官方更新记录
GPT-5.6 已于 2026 年 7 月 9 日正式上线。和发布前的有限预览相比,现在已经能准确回答三个问题:GPT-5.6 比 GPT-5.5 强在哪,普通用户能用到哪些能力,以及是否值得为了它开通 Plus 或 Pro。
GPT-5.6 发布时,Sol 接管了 Medium、High 和更高推理档位,主要面向复杂编程、研究和长流程任务。现在还需注意 GPT-5.5 的退役时间:10月14日,适用于 ChatGPT、ChatGPT Work 和 Codex,API除外。
三句话总结这次升级
- GPT-5.6 的优势集中在长任务和智能体工作流,简单聊天的体感差异没有基准数字那么大。
- Terra 已经超过 GPT-5.5 的部分编程和知识工作表现,同时价格更低,整个系列的单位成本效率明显提升。
- Plus 已经能用 Sol Medium 和 High;Pro 增加 Extra High 与 Sol Pro,适合复杂任务和高强度使用。
GPT-5.6 和 GPT-5.5 的核心区别
| 对比项 | GPT-5.5 | GPT-5.6 |
|---|---|---|
| 产品状态 | 10月14日退出 ChatGPT、Work、Codex,API不受影响 | 已发布,Codex官方迁移目标为5.6 Sol |
| 编程与长任务 | 能完成复杂任务,但持续执行能力较弱 | 更擅长跨文件修改、工具协调、测试和自我修正 |
| 型号结构 | 单代模型为主 | Sol、Terra、Luna 三个长期能力层级 |
| 高算力模式 | Thinking 档位 | max、Extra High、Sol Pro、ultra 等更高配置 |
| API 价格 | 上一代价格体系 | Sol $4/$20,Terra $2/$12,Luna $0.2/$1.2(标准API输入/输出,每百万token) |
GPT-5.6 的变化不只是回答质量提高。它可以在任务过程中编写并运行轻量程序,过滤工具返回的大量中间数据,根据结果调整下一步。对于真实代码库、资料研究和需要多次校验的任务,这种工作方式比单轮生成更重要。
编程能力提升多少
正式发布后的 Terminal-Bench 2.1 数据如下:
| 模型 | 成绩 |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% |
| GPT-5.6 Sol | 88.8% |
| GPT-5.6 Terra | 87.4% |
| GPT-5.5 | 85.6% |
| GPT-5.6 Luna | 84.7% |
这组数据最值得关注的是 Terra。它在该编程基准上超过 GPT-5.5,同时 API 成本更低。Sol 和 Ultra 的优势则更适合难度高、步骤多、需要持续运行工具的任务。
在计算机操作评测 OSWorld 2.0 中,GPT-5.6 Sol 为 62.6%,GPT-5.5 为 47.5%。BrowseComp 中 Sol 为 90.4%,Ultra 为 92.2%,GPT-5.5 为 84.4%。这些提升说明 GPT-5.6 更擅长把搜索、工具调用和结果整理串成完整流程。
发布后的实际体验该怎么看
简单问答与长流程工作的需求不同。修改多个文件、运行测试、分析失败原因、制作完整演示文稿或长时间浏览资料,更容易体现 GPT-5.6 的持续执行能力。GPT-5.5 正在进入退役过渡期,不宜再把它写成长期默认选择。
公开早期反馈与这个判断一致。Cursor 提到 GPT-5.6 的任务持久性和整体效率提升;Lovable 的早期工作流中,完成任务所需步骤减少约 25%,工具调用减少 35% 到 48%,项目成功率提高约 15%。这些数字来自特定产品测试,适合用来理解提升方向,不应当当作所有用户场景的统一结果。
使用时可以先从 Medium 开始。任务经常中断、需要更多校验或跨越较长工作流时,再切换 High、Extra High 或 Sol Pro。这样比所有问题都使用最高档更稳定,也更节省额度。
Plus 和 Pro 分别能用什么
| 套餐 | 标准 ChatGPT 对话 | Codex / ChatGPT Work |
|---|---|---|
| Free / Go | 不能选择 GPT-5.6 Sol | Codex 可用 Terra |
| Plus | Sol Medium、High | 可选 Sol、Terra、Luna,Codex 支持 max、ultra |
| Pro | Medium、High、Extra High、Sol Pro | 可选三个型号,支持更高推理档位 |
| Business / Enterprise | 可用 Sol,受管理员设置影响 | 可选三个型号,具体按工作区权限 |
Plus 已经覆盖了 GPT-5.6 的主要能力。日常写作、资料整理、普通编程和中等长度任务,优先选择 Plus。经常使用 Codex 跑长任务、需要 Extra High 或 Sol Pro、或者高峰期额度经常不够时,再考虑 Pro。
限额有没有增加
OpenAI 没有公布一个所有账号通用的 GPT-5.6 固定消息次数。GPT-5.6 使用现有的自动推理、手动推理和 Pro 限额,具体额度受套餐、工作区设置和系统状态影响。
手动推理与自动路由的计量规则、触及上限后的可用模型,以当前套餐说明和账号界面为准。重置时间可在用量页面查看,具体可用型号以界面提示为准。
API 价格与成本变化
以下为9月16日标准API每百万文本token价格;Sol优惠至少持续至11月21日,长上下文等条件可能影响最终费用。Sol · Terra · Luna
| 型号 | 输入价格 / 1M token | 输出价格 / 1M token |
|---|---|---|
| Sol | $4 | $20 |
| Terra | $2 | $12 |
| Luna | $0.2 | $1.2 |
Terra 和 Luna 的意义在于把接近上一代旗舰的能力放到更低成本档位。对于 API 用户,可以按任务难度分流:难题交给 Sol,常规工作交给 Terra,高频轻任务交给 Luna。ChatGPT 用户则主要通过套餐和推理档位获得类似的分层体验。
FAQ
Q: GPT-5.6 比 GPT-5.5 强多少?
A: 提升集中在编程智能体、工具调用、计算机操作、设计、科研和网络安全。Terminal-Bench 2.1 上 Sol 为 88.8%,GPT-5.5 为 85.6%,Sol Ultra 为 91.9%。
Q: GPT-5.5 会下线吗?
A: 会。OpenAI已宣布10月14日从ChatGPT、ChatGPT Work和Codex退役GPT-5.5,API不受这次调整影响。
Q: Plus 能用到完整的 GPT-5.6 吗?
A: Plus 可以使用 Sol Medium 和 High,也能在 Codex、ChatGPT Work 选择 Sol、Terra、Luna。Extra High 和 Sol Pro 需要 Pro 或更高权限。
Q: GPT-5.6 三个版本怎么选?
A: Sol 处理最难的长任务,Terra 兼顾能力、速度和成本,Luna 适合高频轻任务。标准 ChatGPT 对话不能直接选择 Terra 和 Luna。
Q: 值得为了 GPT-5.6 升级 Pro 吗?
A: 普通用户先用 Plus。只有在高强度 Codex、长任务、Extra High 或 Sol Pro 确实带来价值时,Pro 才更合适。
参考来源
更新记录
- 2026-07-16:按正式发布后的官方数据重写性能、开放档位、限额和使用建议。
- 2026-07-09:GPT-5.6 正式上线。
- 2026-07-06:补充有限预览阶段的基准数据。
- 2026-07-05:首发。