命名规则:数字管代际,名字管档位

GPT-5.6 系列于 2026 年 6 月 26 日进入有限预览,7 月 9 日正式发布,包含三个变体:Sol(旗舰)、Terra(日常均衡)、Luna(低成本快速)。

OpenAI 在发布说明中明确了这套新命名的读法:数字标识模型的代际,而 Sol、Terra、Luna 标识可以各自独立迭代的能力档位。

这句话的信息量比它看起来大。在旧体系里,「GPT-4o → o3 → GPT-5 → GPT-5.2 → GPT-5.4」是一条时间线, 用户的默认策略是「永远用最右边那个」。新体系下,档位是一个持久的维度: 下一代 GPT-5.7 或 GPT-6 出现时,很可能仍然是 Sol / Terra / Luna 三档,只是每一档整体上移。

也就是说,你现在做出的「我的工作流适合 Terra 档」这个判断,在未来几代里是可以复用的, 而「我要用最新的那个」这个策略会持续失效。

另外两个随 GPT-5.6 引入的机制值得留意:

  • max reasoning effort:给 Sol 提供最高的推理时长上限,用于最难的问题。
  • ultra 模式:通过调用子智能体(subagents)加速复杂工作,能力超出单一智能体的范围。

这两项都指向同一个方向——推理深度从「模型的固有属性」变成了「用户可调的参数」。 这也是 下一篇实操指南 的主线。

最容易踩的坑:同一个订阅,不同界面拿到的模型不一样

这是本文最想强调的一点,也是大多数对照表没有说清楚的地方。

「我是 Plus 用户,所以我一直在用 Sol」——这个推论是错的。

2026 年 8 月 6 日,OpenAI 发布了一次针对日常对话重新调校的 Sol,同时明确说明:这个重调版本只作用于 ChatGPT 的 Chat(常规对话)界面; 驱动 ChatGPT Work 与 Codex 的 Sol 版本在本次发布中没有改变, API 侧也没有宣布对应更新。

入口说明
ChatGPT Chat日常对话场景,8 月 6 日起为重调版 Sol(Plus / Pro)
ChatGPT Work多步骤任务智能体,Sol 版本未随本次更新变化
Codex编程智能体,Sol 版本未随本次更新变化
API未宣布同步更新,新的回答风格与准确率数字不应假定适用

实践含义很直接:你在常规对话里测出来的「这个模型写代码风格是这样」, 不能直接外推到 Codex 里。反过来也一样。 如果你在做模型能力评测或团队内部选型,务必标明测试是在哪个入口做的。

8 月 6 日更新:免费层和付费层各自变了什么

这次更新是普通用户感知最强的一次,两半内容分别面向两类人群。

Plus / Pro 用户

  • 拿到针对日常对话重调的 GPT-5.6 Sol:回答更聚焦、按问题调整详略、减少不必要的格式化,并且在单纯附和不合适时会给出纠正。
  • 新增一个思考程度滑杆,可在网页、移动端和桌面端调节 ChatGPT 为每个回答投入多少思考。
  • OpenAI 表示此次更新让 Instant 与 Thinking 两种体验更接近——从低强度切到高强度时应当感觉像是「同一个模型多花了些时间」,而不是换了一个语气和风格都不同的模型。

Free / Go 用户

  • 默认模型从 GPT-5.5 Instant 换成 GPT-5.6 Luna
  • 获得无限文本对话(受滥用防护限制)。
  • 新增 Think 按钮,可以为较难的问题调用更高强度的推理。

但 Think 按钮有一个必须说清的限制:它只是给 Luna 更多思考时间, 不会把问题路由到 Sol 或 Terra。免费用户得到的是更大的用量和一个想得更久的小模型,而不是更强的模型

「无限」的边界也要看清:只覆盖文本对话。 文件上传、图像分析、语音对话、图像生成等工具仍然受限。

那个被反复引用的百分比

OpenAI 在一项针对金融、医疗、法律类需要事实细节的提问所做的内部评测中,测得包含至少一处事实错误的回答,Luna 比 GPT-5.5 Instant 少约 62%,Sol 少约 68%

引用这个数字时请注意三个限定条件:它是内部评测、 限定在特定三类事实性提问、基线是 GPT-5.5 Instant。 把它简化成「新模型准确率提高 62%」是一种失真的转述。 另外 OpenAI 未公布题集、样本量与评分方法,也没有第三方复现过该结果。

能力与价格边界

档位OpenAI 的定位典型适用
Sol旗舰,最强模型复杂推理、编程、科研分析、长链路智能体工作流
Terra均衡型,日常工作性能对标上一代 GPT-5.5,但成本约为其一半
Luna快速、低成本高频、低复杂度的日常任务

在能力侧,OpenAI 公布的评测重点集中在三个方向:

  • 编程:Sol 在 Terminal-Bench 2.1(考察命令行工作流中的规划、迭代与工具协同)上创下新的最佳成绩。
  • 生物学:在评估长周期基因组学与定量生物学分析的 GeneBench v1 上,Sol 以更少的 token 取得优于 GPT-5.5 的结果。
  • 网络安全:OpenAI 称 Sol 是其迄今最强的网络安全模型,在长周期安全任务上推进了性能—效率前沿。

需要注意的是,安全能力的提升伴随着更严格的管控。OpenAI 说明 GPT-5.6 配备了其迄今最完整的分层防护体系, 包括模型内训练的拒答、生成过程中的实时分类器审查、账号级风险复核与差异化访问; 并且明确提示,预览期内合法用途也可能触发拦截或因额外审查而变慢, 尤其是在防御与攻击特征相似的双用途安全场景。 如果你的工作涉及漏洞研究、代码审计一类内容,这是一个需要预留容错的现实约束。

定价(API,每百万 token)

注意这里有一次容易被忽略的调价。OpenAI 于 2026 年 7 月 30 日——发布仅三周后——官方下调了 Terra 与 Luna 的价格:

档位发布时当前(7-30 起)变化
Sol$5 / $30$5 / $30不变,新增 Fast mode
Terra$2.50 / $15$2.00 / $12−20%
Luna$1 / $6$0.20 / $1.20−80%

缓存输入同比例下调:Terra 至 $0.20、Luna 至 $0.02。 ChatGPT 与 Codex 的订阅价格和配额预算保持不变,但 Terra 与 Luna 的用量现在消耗更少额度。

实践提醒:如果你的技术栈里硬编码了旧价格,Luna 的成本数字被高估了 5 倍。

GPT-5.6 同时引入了更可预测的 prompt caching:支持显式缓存断点、30 分钟最短缓存生命周期; 缓存写入按未缓存输入价的 1.25 倍计费,缓存读取继续享受 90% 折扣。 对于有大量重复系统提示的应用,这一项对实际账单的影响可能超过基础单价。

已经退役的模型:别再照着 2025 年的教程操作

如果你手上的资料还在讲 GPT-4o 怎么用、o3 和 o4-mini 的区别,那份资料已经完全失效:

  • GPT-4o:2026 年 1 月 29 日宣布退役,2 月 13 日正式下线。
  • o3 / o4-mini / o4-mini-high:同批退役,o4-mini 的退役公告同为 1 月 29 日。
  • GPT-5.4 系列(2026 年 3 月 5 日发布)、GPT-5.5 系列(4 月发布,5 月 5 日推出 GPT-5.5 Instant)已被 GPT-5.6 取代。

这一轮清理的规模不小——GPT-5.4 家族发布时就已经替换掉了此前的全部世代。 任何提到「在模型选择器里找到 GPT-4o」的教程都可以直接丢弃。

选型决策路径

按顺序回答四个问题即可:

1. 你是通过 ChatGPT 界面用,还是通过 API 用?

  • 界面 → 你的选择权取决于订阅层级,跳到问题 2。
  • API → 你可以自由选档,跳到问题 3。

2. 你的任务在 ChatGPT 界面里属于哪一类?

  • 事实查询、改写、翻译、日常问答 → Luna 档足够,免费层即可,遇到难题按 Think。
  • 需要多步推理的分析、写作、研究 → 需要 Plus 及以上以获得 Sol,并把思考滑杆推高。
  • 长时间运行的编程或多步骤任务 → 走 Codex / Work 入口,注意其模型版本与 Chat 独立。

3. API 场景下,成本与质量哪个是主约束?

  • 高频、简单、成本敏感(分类、抽取、摘要)→ Luna,降价后成本优势非常突出。
  • 通用生产负载 → Terra,性能对标 GPT-5.5 而成本更低,是多数应用的默认选择。
  • 复杂推理、智能体链路、对错误代价高的场景 → Sol,必要时开 max reasoning effort。

4. 有没有大量重复的系统提示?

  • 有 → 认真配置 prompt caching 的显式断点,这对账单的影响可能大于换档。

一个反直觉但实用的结论:多数团队的正确做法不是全线上 Sol, 而是把 Terra 设为默认、把 Luna 用在高频简单调用上、只在少数关键节点调用 Sol。OpenAI 把 Terra 定位为「性能对标上一代旗舰而价格更低」,本身就是在引导这种分层用法, 7 月 30 日的降价进一步强化了这个信号。

本文的不确定项

出于准确性考虑,以下内容在核验时仍存在来源冲突或未获官方确认:

  1. 各订阅层级的完整功能对照——多家第三方对照页在 Pro 的 $100 与 $200 两档差异上互相矛盾,应以 OpenAI 官方定价页与帮助中心为准。我们的整理见 套餐对比
  2. 广告投放的地区与层级范围——第三方来源说法不一。
  3. GPT-5.6 的可用地区——OpenAI 的服务支持地区列表随时可能调整。

更新说明:本文初稿曾把 7 月 30 日的调价标为「待核实」。该调价现已由 OpenAI 官方页面 《Advancing the price-performance frontier with GPT-5.6》确认,正文与价格表已据此更新。

参考来源

下一篇:ChatGPT 实操指南(2026 年 8 月版):思考滑杆、Think 按钮与 Agent 工作流——把本文的选型结论落到具体操作上。