GPT-6 Astra 是什么
OpenAI 在 2026 年 9 月 3 日发布 GPT-6 Astra,称之为「最智能、最对齐的模型」。 它是 GPT-5.6 Sol / Terra / Luna 之上的新一代——命名规则没变:数字代表世代,Astra 是这一代目前唯一的档位。
| 参数 | GPT-6 Astra(官方模型页) |
|---|---|
| API 模型 ID | gpt-6-astra |
| 上下文窗口 | 1,050,000 token |
| 最大输出 | 128,000 token |
| 知识截止 | 2026 年 4 月 30 日 |
| 输入 / 输出 | 文本 + 图像 / 文本 |
| 推理力度 | low、medium、high、xhigh、max |
| 内置工具 | web_search、file_search、image_generation、code_interpreter、hosted_shell、apply_patch、skills、computer_use、mcp、tool_search |
| 支持接口 | Responses、Chat Completions、Batch;不支持 Realtime、Assistants、微调、Embeddings |
OpenAI 自报的基准提升几乎全在长程 Agent 任务上:Terminal-Bench 4.0 从 Sol 的 37.3% 到 57.9%, OSWorld 2.0 从 65.7% 到 72.6%,FrontierMath Tier 4 从 83.0% 到 97.6%;而 DeepSWE v1.1 只从 72.7% 到 74.1%。如果你的使用方式是问答和写作,Astra 相对 Sol 的差距远小于价格差距。
另一个第一次:Astra 是 OpenAI 首个越过其 Preparedness Framework「Critical」网络安全阈值的模型。 公开版本会拒绝高级攻防类任务,完整能力只通过名为 Daybreak 的可信访问计划给经过审核的防御方; ChatGPT 里的安全监控可以暂停运行、API 里可以直接终止被标记的任务。
三个入口、三套规则:Chat、Work、Codex
这是本次发布最容易让人困惑的地方。ChatGPT 现在有三个入口:Chat(普通对话)、Work(跑长任务的 Agent)、Codex(软件开发)。同一个模型在三个入口里的可用档位和名字都不一样。
| 档位 | Chat 里的 GPT-6 Pro | Work / Codex 里的 GPT-6 Astra |
|---|---|---|
| Free | 无 | 官方定价页列入可用,额度极小 |
| Go | 无 | 同上 |
| Plus | 无 | 有,5 小时约 5–45 条 |
| Pro $100(ClaudeMax 的 Pro 5x) | 有(第三方报道:每周约 50 条) | 有,5 小时约 25–225 条 |
| Pro $200(ClaudeMax 的 Pro 20x) | 有(第三方报道:每周约 200 条) | 有,5 小时约 100–900 条 |
| Business Standard | 有 | 有,5 小时约 5–45 条 |
| Business Premium / Enterprise | 有(Enterprise 需管理员开启) | 有,用完整的既有额度 |
几个要点:
- Work 和 Codex 共用一份额度,官方原话是本地消息与云端对话共享套餐额度;Astra 没有单独的一份。
- 官方给的是估算区间而不是固定上限,实际条数取决于每条消息的 token 量;聊天入口的每周上限只有第三方报道,官方文档没有写成数字。
- 按积分计价时,Astra 是每百万输入 250 积分、缓存输入 25 积分、输出 1,250 积分,Fast 模式再乘 2.5。
- 官方明确说过买积分不能提前获得访问权;积分只是额度用完之后的补充。
额度到底比 Sol 少多少
把官方定价页上两个模型的估算区间放在一起,答案很直接:同一份额度,Astra 大约只能发 Sol 的一半。
| 档位 | GPT-5.6 Sol(5 小时) | GPT-6 Astra(5 小时) |
|---|---|---|
| Plus / Business Standard | 10–100 条 | 5–45 条 |
| Pro 5x | 50–500 条 | 25–225 条 |
| Pro 20x | 200–2,000 条 | 100–900 条 |
所以合理的用法不是全程开 Astra,而是把它留给真正的长程任务——多步骤的代码重构、要跑很久的 Agent 流程、跨几十个文件的分析; 日常问答继续用 Sol,就像之前把 Sol 留给重活、把 Luna 留给闲聊一样。 这一点和 GPT-5.6 三个模型怎么选 里的逻辑完全一致,只是又往上加了一层。
API 定价:2.5 倍,加一个长上下文陷阱
| 项目 | GPT-6 Astra | GPT-5.6 Sol(7-30 降价后) |
|---|---|---|
| 输入 / 百万 token | $10 | $4 |
| 缓存输入 / 百万 token | $1 | — |
| 输出 / 百万 token | $50 | $20 |
| Batch | 五折 | 五折 |
| Fast 模式 | 两倍 | 两倍 |
| 超过 272K 输入的请求 | 整单按 2 倍输入价、1.5 倍输出价 | — |
最后一行要单独强调。1M 上下文听起来很诱人,但一旦单次输入超过 272K token,整个请求的价格变成 $20 / $75。 对多数任务,把长文档切分、或者靠缓存输入(只要 $1)复用前缀,比一次塞进去便宜得多。 具体手法见 GPT-5.6 API 降本实战,在 Astra 的价格下每一条都更值钱。
速率限制按账户等级分层:Tier 1 每分钟 50 万 token,Tier 5 到 4,000 万。模型同时上了 Amazon Bedrock 和 Microsoft Foundry(后者走受限访问计划)。
发布过程:三天从「只给少数机构」到全量
- 9 月 3 日:发布当天只向少数机构开放(主要是接入 Daybreak 安全平台的企业),Pro 用户花最多的钱却没拿到,官方发布帖下面被刷屏。
- 9 月 3 日晚:Codex 负责人 Thibault Sottiaux 宣布补偿——付费用户每等一天,补一次 banked reset(可以存着以后用的额度重置)。
- 9 月 4 日:Altman 公开为「messy」的发布道歉;当天晚些时候 Pro、Enterprise、Business Premium 在 Work / Codex 里拿到 Astra,API 同步开放,随后开始推 Plus 和 Business。
- 9 月 5 日:官方宣布推送完成,所有 Plus / Pro / Business 账号再补一次完整的 banked reset,当天 8pm PT 前注册或升级的账号也算。
以上时间线来自 OpenAI 员工的公开发帖和第三方报道,官方帮助中心只写了「as it rolls out」。 实践含义有两个:一是现在(9 月 7 日)各档已经推完,你账号里没有不是没推到,是档位不对; 二是你的账号里大概率躺着一次没用的 banked reset,先把它用掉再决定要不要升档。
国内用户怎么选
| 你的需求 | 该买的档 | ClaudeMax 价格(以下单页为准) |
|---|---|---|
| 只想在 Codex 里试试 Astra,日常用 Sol | Plus | ¥185 / 月 |
| 要在聊天里直接选 GPT-6 Pro,每周几十条重活 | Pro 5x(Pro $100) | ¥920 / 月 |
| 重度 Agent / 编程,每周上百条 Astra | Pro 20x(Pro $200) | ¥1,990 / 月 |
| 团队多人各自用 | Business 席位(本站不售)或各买个人档 | — |
两条规则不变:Pro 档要求账号当前处于 Free 或 Plus 状态,Plus 未到期时可以直接下单升级; 所有 ChatGPT 订阅都是微信支付,交付后订阅在你自己的账号上,不涉及共享。 Go 档国内本来就不好买,而且聊天入口没有 GPT-6,不必为它绕路。
最后一个判断标准:如果你说不出自己哪类任务需要 Astra 而 Sol 做不好,就还不需要升 Pro。OpenAI 自己的基准也显示普通推理的提升有限,先在 Codex 里用 Plus 的额度试一周,看真实差异再花钱。
本文数据截至 2026 年 9 月 7 日。可用档位与额度仍在推送期内调整,聊天入口的每周上限为第三方报道,请以账号内官方提示为准。