为什么又要分三个
GPT-5.6 于 2026 年 7 月 9 日正式发布(6 月 26 日起有限量预览), 和以往「一个版本号一个模型」不同,这一代直接拆成了三个规格:Sol(太阳)、Terra(地球)、Luna(月亮)。
这个命名法让不少人一头雾水——这和 Anthropic 那边同时冒出 Sonnet 5、Opus 4.8、Fable 5、Mythos 5 是一样的困扰(我们写过那一篇)。 但拆分本身的逻辑其实很直白:让你按任务难度付费,而不是永远按最贵的付。
三者核心区别
| 维度 | Sol(太阳) | Terra(地球) | Luna(月亮) |
|---|---|---|---|
| 定位 | 旗舰 / 极致能力 | 均衡 / 性价比 | 最快 / 最便宜 |
| Model ID | gpt-5.6-sol | gpt-5.6-terra | gpt-5.6-luna |
| API 价格(当前) | $5 / $30 | $2.00 / $12 | $0.20 / $1.20 |
| 发布时价格 | $5 / $30(未变) | $2.50 / $15 | $1 / $6 |
| 上下文窗口 | 约 105 万 token(三者相同) | ||
| 最大输出 | 128K(三者相同) | ||
| 知识截止 | 2026-02-16(三者相同) | ||
价格单位为每百万 token 的输入 / 输出价。
发布仅三周就降过一次价,这条最容易搞错:2026 年 7 月 30 日 OpenAI 官方下调价格—— Luna 降 80%($1/$6 → $0.20/$1.20)、Terra 降 20%($2.50/$15 → $2.00/$12), Sol 价格不变但新增 Fast mode。缓存输入同比例下调:Luna 至 $0.02、Terra 至 $0.20。
如果你的成本表还写着 Luna $1/$6,你把成本高估了 5 倍。订阅价与配额预算未变,但 Terra 和 Luna 的用量现在消耗更少额度。
能力差距有多大
OpenAI 称 Sol 在编程、知识工作、网络安全和科学领域取得业界领先成绩, 并且用更少的 token、更低的估算成本超过了以往的前沿模型。第三方评测里比较有参考价值的两组:
- Artificial Analysis 编程 Agent 指数 v1.1:最大推理档的 Sol 得 80 分, 比 Anthropic 的 Fable 5 高 2.8 分,且输出 token 不到一半、耗时不到一半、成本约低三分之一。 Terra 略高于 Fable 5,Luna 超过 Claude Opus 4.8。
- Terminal-Bench 2.1:Sol 88.8%(Sol Ultra 91.9%),Luna 84.3%。
第二组数据是这篇文章里最值得记住的:最便宜的 Luna 和旗舰 Sol 只差 4.5 个百分点。很多人默认「便宜的肯定不能用」,在 GPT-5.6 这一代并不成立。
benchmark 数字来自公开评测与官方公布值,不同榜单的测试条件和版本可能不一致,建议以官方页面为准。
关键:你的套餐决定你能选谁
这部分是实际使用中最容易搞混的。2026 年 8 月 6 日 OpenAI 做过一次调整, 网上大量对照表还停留在调整之前,包括本文早先的版本。以下为调整后的现状:
| 套餐 | 常规对话默认模型 | 推理强度控制 |
|---|---|---|
| Free / Go | GPT-5.6 Luna(替代原 GPT-5.5) | Think 按钮 |
| Plus / Pro | GPT-5.6 Sol(针对日常对话重调版) | 思考程度滑杆 |
免费层最需要注意的一条:Think 按钮只是让 Luna 想得更久,不会把问题路由到 Sol 或 Terra。免费用户拿到的是更大的量(无限文本对话,受滥用防护限制)和一个想得更久的小模型,不是更强的模型。文件上传、图像分析、语音、图像生成仍然受限。
Plus / Pro 侧则是拿到一个滑杆,可在网页、移动端和桌面端调节每次回答投入多少思考。 OpenAI 的设计意图是让 Instant 与 Thinking 两种体验合并——从低档切到高档应当像 「同一个模型多花了些时间」,而不是换了个模型。
还有一个更隐蔽的坑:8 月 6 日的重调只作用于常规对话, 驱动 ChatGPT Work 与 Codex 的 Sol 版本没有变化,API 侧也没有同步更新。 也就是说同一个账号、同一个模型名,三个入口的实际行为可能不同—— 详见 GPT-5.6 命名逻辑与入口差异。
API 侧不受这些界面规则约束:三档都可自由调用并各自设置推理强度。
这一代新增的两个档位
- max 推理强度:在原有档位之上再加一档。
- ultra 模式:使用子智能体(subagents)处理复杂工作。
这两个是本代在「让模型想更久 / 拆得更细」方向上的加码, 和 Anthropic 那边的 Effort 档位与并行子智能体是同一个思路。
怎么选:三个问题
不用背表格,问自己三个问题就够了:
- 这件事难不难?
- 这件事多不多?
- 失败了代价大不大?
| 答案组合 | 选 | 典型任务 |
|---|---|---|
| 难,且失败代价高 | Sol | 复杂代码生成、架构设计、多文件修改、难 bug、关键安全分析、长上下文 Agent |
| 日常强度 | Terra | 大多数开发、写文档、分析日志、普通 Agent、代码解释、脚本生成 |
| 量大且低风险 | Luna | 分类、摘要、简单问答、格式转换、批量清洗、短文本处理 |
两个容易踩的坑
坑一:alias 陷阱
API changelog 里,gpt-5.6 这个 alias 指向 gpt-5.6-sol。 你以为自己只是「升级到 GPT-5.6」,实际可能把默认请求全打到了最贵的 Sol 上。
生产环境永远显式写全模型名。这不只是省钱问题——alias 的指向未来可能变,写死才能保证行为稳定。
坑二:旧模型退役时间表
2026 年下半年有一连串退役,排期比较密:
| 模型 | 退役时间 | 替代 |
|---|---|---|
| GPT-4.5 | 已于 2026 年 6 月下线 | — |
| OpenAI o3(ChatGPT) | 2026-08-26 | — |
| gpt-5.4(Codex) | 2026-08-31 | gpt-5.6-terra |
| gpt-5.4-mini(Codex) | 2026-08-31 | gpt-5.6-luna |
这些变更针对 ChatGPT 与 Codex 场景,API 侧的政策另行公布。 如果你的脚本里写死了 gpt-5.4,现在就该改。
顺带说说 GPT-5.5 的变化
GPT-5.5 Instant 最近做过一次风格优化:回答更易读、日常对话更自然, 过长或过多项目符号的回答明显减少。
但有个功能性变化容易被忽略:画布(Canvas)不再可用于 GPT-5.5 Instant 或 GPT-5.5 Thinking, 写作和编程改由「写作块」和「代码块」直接在聊天回答中承载。 付费用户可以在旧版模型下线前继续限时使用画布。
一句话总结
Sol 要能力,Terra 要平衡,Luna 要效率——但前提是你的套餐让你选。 Free 和 Go 用户没得选(默认 Luna,Think 按钮也只是让 Luna 想更久), 想拿到 Sol 和思考程度滑杆,至少需要 Plus。 API 用户则记住两条:别写 gpt-5.6,写全名; 以及按 7-30 之后的新价重算成本——Luna 已经降到 $0.20/$1.20。