为什么又要分三个

GPT-5.6 于 2026 年 7 月 9 日正式发布(6 月 26 日起有限量预览), 和以往「一个版本号一个模型」不同,这一代直接拆成了三个规格:Sol(太阳)、Terra(地球)、Luna(月亮)

这个命名法让不少人一头雾水——这和 Anthropic 那边同时冒出 Sonnet 5、Opus 4.8、Fable 5、Mythos 5 是一样的困扰(我们写过那一篇)。 但拆分本身的逻辑其实很直白:让你按任务难度付费,而不是永远按最贵的付

三者核心区别

维度Sol(太阳)Terra(地球)Luna(月亮)
定位旗舰 / 极致能力均衡 / 性价比最快 / 最便宜
Model IDgpt-5.6-solgpt-5.6-terragpt-5.6-luna
API 价格(当前)$5 / $30$2.00 / $12$0.20 / $1.20
发布时价格$5 / $30(未变)$2.50 / $15$1 / $6
上下文窗口约 105 万 token(三者相同)
最大输出128K(三者相同)
知识截止2026-02-16(三者相同)

价格单位为每百万 token 的输入 / 输出价。

发布仅三周就降过一次价,这条最容易搞错:2026 年 7 月 30 日 OpenAI 官方下调价格—— Luna 降 80%($1/$6 → $0.20/$1.20)、Terra 降 20%($2.50/$15 → $2.00/$12), Sol 价格不变但新增 Fast mode。缓存输入同比例下调:Luna 至 $0.02、Terra 至 $0.20。

如果你的成本表还写着 Luna $1/$6,你把成本高估了 5 倍。订阅价与配额预算未变,但 Terra 和 Luna 的用量现在消耗更少额度。

能力差距有多大

OpenAI 称 Sol 在编程、知识工作、网络安全和科学领域取得业界领先成绩, 并且用更少的 token、更低的估算成本超过了以往的前沿模型。第三方评测里比较有参考价值的两组:

  • Artificial Analysis 编程 Agent 指数 v1.1:最大推理档的 Sol 得 80 分, 比 Anthropic 的 Fable 5 高 2.8 分,且输出 token 不到一半、耗时不到一半、成本约低三分之一。 Terra 略高于 Fable 5,Luna 超过 Claude Opus 4.8。
  • Terminal-Bench 2.1:Sol 88.8%(Sol Ultra 91.9%),Luna 84.3%。

第二组数据是这篇文章里最值得记住的:最便宜的 Luna 和旗舰 Sol 只差 4.5 个百分点。很多人默认「便宜的肯定不能用」,在 GPT-5.6 这一代并不成立。

benchmark 数字来自公开评测与官方公布值,不同榜单的测试条件和版本可能不一致,建议以官方页面为准。

关键:你的套餐决定你能选谁

这部分是实际使用中最容易搞混的。2026 年 8 月 6 日 OpenAI 做过一次调整, 网上大量对照表还停留在调整之前,包括本文早先的版本。以下为调整后的现状:

套餐常规对话默认模型推理强度控制
Free / GoGPT-5.6 Luna(替代原 GPT-5.5)Think 按钮
Plus / ProGPT-5.6 Sol(针对日常对话重调版)思考程度滑杆

免费层最需要注意的一条:Think 按钮只是让 Luna 想得更久,不会把问题路由到 Sol 或 Terra。免费用户拿到的是更大的量(无限文本对话,受滥用防护限制)和一个想得更久的小模型,不是更强的模型。文件上传、图像分析、语音、图像生成仍然受限。

Plus / Pro 侧则是拿到一个滑杆,可在网页、移动端和桌面端调节每次回答投入多少思考。 OpenAI 的设计意图是让 Instant 与 Thinking 两种体验合并——从低档切到高档应当像 「同一个模型多花了些时间」,而不是换了个模型。

还有一个更隐蔽的坑:8 月 6 日的重调只作用于常规对话, 驱动 ChatGPT Work 与 Codex 的 Sol 版本没有变化,API 侧也没有同步更新。 也就是说同一个账号、同一个模型名,三个入口的实际行为可能不同—— 详见 GPT-5.6 命名逻辑与入口差异

API 侧不受这些界面规则约束:三档都可自由调用并各自设置推理强度。

这一代新增的两个档位

  • max 推理强度:在原有档位之上再加一档。
  • ultra 模式:使用子智能体(subagents)处理复杂工作。

这两个是本代在「让模型想更久 / 拆得更细」方向上的加码, 和 Anthropic 那边的 Effort 档位与并行子智能体是同一个思路。

怎么选:三个问题

不用背表格,问自己三个问题就够了:

  1. 这件事难不难?
  2. 这件事多不多?
  3. 失败了代价大不大?
答案组合典型任务
难,且失败代价高Sol复杂代码生成、架构设计、多文件修改、难 bug、关键安全分析、长上下文 Agent
日常强度Terra大多数开发、写文档、分析日志、普通 Agent、代码解释、脚本生成
量大且低风险Luna分类、摘要、简单问答、格式转换、批量清洗、短文本处理

两个容易踩的坑

坑一:alias 陷阱

API changelog 里,gpt-5.6 这个 alias 指向 gpt-5.6-sol。 你以为自己只是「升级到 GPT-5.6」,实际可能把默认请求全打到了最贵的 Sol 上。

生产环境永远显式写全模型名。这不只是省钱问题——alias 的指向未来可能变,写死才能保证行为稳定。

坑二:旧模型退役时间表

2026 年下半年有一连串退役,排期比较密:

模型退役时间替代
GPT-4.5已于 2026 年 6 月下线
OpenAI o3(ChatGPT)2026-08-26
gpt-5.4(Codex)2026-08-31gpt-5.6-terra
gpt-5.4-mini(Codex)2026-08-31gpt-5.6-luna

这些变更针对 ChatGPT 与 Codex 场景,API 侧的政策另行公布。 如果你的脚本里写死了 gpt-5.4,现在就该改。

顺带说说 GPT-5.5 的变化

GPT-5.5 Instant 最近做过一次风格优化:回答更易读、日常对话更自然, 过长或过多项目符号的回答明显减少。

但有个功能性变化容易被忽略:画布(Canvas)不再可用于 GPT-5.5 Instant 或 GPT-5.5 Thinking, 写作和编程改由「写作块」和「代码块」直接在聊天回答中承载。 付费用户可以在旧版模型下线前继续限时使用画布。

一句话总结

Sol 要能力,Terra 要平衡,Luna 要效率——但前提是你的套餐让你选。 Free 和 Go 用户没得选(默认 Luna,Think 按钮也只是让 Luna 想更久), 想拿到 Sol 和思考程度滑杆,至少需要 Plus。 API 用户则记住两条:别写 gpt-5.6,写全名; 以及按 7-30 之后的新价重算成本——Luna 已经降到 $0.20/$1.20。