2026年7月9日,OpenAI正式将GPT-5.6系列模型从"可信伙伴预览"扩展为全球公开发布。Sol、Terra、Luna三款子模型同步向更广泛用户开放,并开始向ChatGPT、Codex和API滚动上线。这不是一次简单的模型升级,而是AI行业从"拼参数"到"拼匹配"的范式转移。
三档模型,面向三类任务
GPT-5.6使用全新命名方式:数字代表模型世代,Sol、Terra、Luna代表可以独立迭代的长期能力档位。
- Sol(旗舰):输入$5/百万token,输出$30/百万token。面向高难度编程、研究、复杂知识工作等任务失败代价很高的场景。
- Terra(均衡):输入$2.5/百万token,输出$15/百万token。性能与成本平衡,适合日常开发、文档分析、稳定批处理。
- Luna(轻量):输入$1/百万token,输出$6/百万token。最快、最低价,适合高频调用、简单任务和延迟敏感场景。
关键提醒:日常快速问答仍由GPT-5.5 Instant承担,当用户选择Medium、High或Extra High推理强度时,系统才会调用GPT-5.6 Sol。Pro方案还可使用能力更高的Sol Pro。
max与ultra:两种不同的推理增强
GPT-5.6引入了两种推理增强模式:
- max:给单个模型更多推理时间,适合需要深挖、反复检查、探索多种方案的任务。
- ultra:让多个子Agent并发推进再汇总结果,适合可以拆分、需要并行研究的复杂任务。官方评测中Ultra使用四个Agent,Terminal-Bench 2.1从Sol的88.8%提升至91.9%。
并行不是免费加速,总输出token和API成本包含全部Agent,简单问答强行并行只会增加消耗。
Codex并入ChatGPT:统一工作流
与此同时,OpenAI做了一个更值得关注的产品架构调整——Codex不是被取消,而是成为新版ChatGPT桌面端中的独立工作模式。
新版ChatGPT桌面应用将三个入口合一:
- Chat:问答与讨论,最轻量的入口
- Work:研究、分析、连接应用与文件,制作文档、表格和演示文稿,支持定时或触发式任务
- Codex:阅读代码库、修改文件、运行测试、处理多仓库的工程代理
合并后,用户可以在同一个产品中共享上下文,无需在ChatGPT和Codex之间来回切换。对于企业用户,这意味着权限、数据和审阅体系可以统一管理。
安全审查与分批开放
值得注意的是GPT-5.6的发布节奏:6月26日首次发布仅面向美国境内可信合作伙伴,原因在于美国商务部要求做安全评估。经过两周审查,三个模型在网络安全和生物/化学风险上均为"高"评级,但未达到"网络关键"阈值,三层安全防护兜底后方才全球开放。
这标志着前沿AI模型进入"先通知、再评估、然后放行"的监管新模式。Terra和Luna的地理限制相对宽松,但旗舰级的Sol很可能因安全性考量面临更严格的区域限制。
对普通用户和开发者的建议
普通用户:日常问答继续用GPT-5.5 Instant,复杂任务(研究整理、文件分析、代码排查)切换到GPT-5.6 Sol的更高推理档位即可。
开发者与企业:务实的组合是——默认用Terra跑日常任务,简单高频任务下沉到Luna,复杂高风险任务升级到Sol,只有任务天然可并行时才打开ultra。最好的模型不是名字最响的那个,而是能用最低总成本把任务稳定做完的那个。
GPT-5.6的价值不只是"更强",而是OpenAI正在把模型能力、推理强度、并行Agent和成本做成可选择的矩阵。下一阶段的AI竞争,不是谁更会回答问题,而是谁能在获得授权后,稳定地把任务接过去、做完,并留下可审阅的结果。