规格与价格:一张表
| 项目 | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| 发布 | 2026-09-03 | 2026-09-01 |
| API 模型 ID | gpt-6-astra | claude-fable-5-1 |
| 上下文窗口 | 1,050,000 token | 1,000,000 token(默认即最大) |
| 最大输出 | 128,000 | 128,000 |
| 输入 / 输出(每百万 token) | $10 / $50 | $10 / $50 |
| 缓存读取 | $1 | $0.25 |
| 缓存写入 | $12.50 | $12.50(5 分钟)/ $20(1 小时) |
| 长上下文规则 | 超过 272K 输入:整单 2 倍输入价、1.5 倍输出价 | 全窗口标准价,无附加费 |
| 输入 / 输出模态 | 文本 + 图像 / 文本 | 文本 + 图像 / 文本 |
| 推理控制 | effort:low 到 max | 自适应思考始终开启,effort 控制深度 |
| 知识截止 | 2026-04-30 | 官方未在发布页标注 |
看账单的人应该盯住两行:缓存读取和长上下文规则。 Agent 任务的典型形态是同一份系统提示、工具定义和文档前缀被几十次重复送入,这部分几乎全走缓存读取——Fable 5.1 的 $0.25 对 Astra 的 $1 是 4 倍差。 Anthropic 自己给的数字是典型负载比 Fable 5 省约 25%,高度 Agent 化的任务省到 45%。 而 Astra 的 272K 门槛意味着「把整个代码库塞进去」这件事要付 $20 / $75 的价格, 实操建议见下文「API 侧的两个坑」。
基准:只有一项能直接对比
两家都只公布自己跑的数字,且各自挑基准。把两边都出现的那一项单独拎出来:
| Terminal-Bench 4.0(Agent 编程) | 成绩 | 数据来源 |
|---|---|---|
| GPT-6 Astra | 57.9% | OpenAI 自报 |
| Claude Fable 5.1 | 55.8% | Anthropic 自报 |
| Claude Opus 5 | 52.3% | Anthropic 自报 |
| GPT-5.6 Sol | 37.3% | 两家均有,数字一致 |
结论很朴素:两家旗舰在误差范围内,而且 Opus 5 离它们也不远;真正被甩开的是上一代的 Sol。 Anthropic 发布页的其余对比(同一口径下 Fable 5.1 / Opus 5 / Sol):CursorBench 3.2.0 为 73.4% / 70.0% / 67.2%, AutomationBench 为 31.4% / 26.9% / 19.6%,GDPval-AA v2 知识工作为 1853 / 1824 / 1711,Terminal-Bench-Science 为 52.6% / 29.0% / 22.4%。 OpenAI 侧则强调 FrontierMath Tier 4 97.6%(Sol 83.0%)、OSWorld 2.0 72.6%(Sol 65.7%)。 注意 OSWorld 2.0 两家用的评分口径不同(Anthropic 分 partial 77.9% 与 strict 41.7%),不要把 72.6% 和它们放在一行比。
还有一个影响读数的细节:Anthropic 明确说 Fable 5.1 是开着生产环境安全防护评测的,防护介入的任务直接记零分。 这让它的数字偏保守,也说明你在真实使用中遇到的行为和榜单一致。
安全边界:两家都有「用不了」的场景
- Astra 是 OpenAI 首个越过 Preparedness Framework「Critical」网络安全阈值的模型。公开版本拒绝高级攻防任务,完整能力只给 Daybreak 可信访问计划里的防御方;ChatGPT 里的安全监控可以暂停运行,API 里可以直接终止被标记的任务。
- Fable 5.1 与 Mythos 5.1 是同一个模型、不同防护级别。这次防护做了调整:Claude Code 用户的网络安全误拦截平均少约 60%,可以用它发现软件漏洞但不能开发利用程序。
- 文本水印:Anthropic 对 2026 年 8 月 2 日之后发布的模型输出加了统计学水印,并在小范围预览检测 API。写公开内容的人要知道这一点,境内发布的标识义务见 标识办法实操。
订阅里怎么用:这才是多数人的真实差别
| 你的套餐 | GPT-6 Astra | 你的套餐 | Claude Fable 5.1 |
|---|---|---|---|
| Free / Go | 聊天里没有;Codex 里额度极小 | Free | 不可用 |
| Plus(¥185) | 只在 Work / Codex,5 小时约 5–45 条 | Pro(¥249) | 能选,但不含在套餐里,按 API 价扣 usage credits,5.1 没有补偿额度 |
| Pro $100 = Pro 5x(¥920) | 聊天里的 GPT-6 Pro(第三方报道约 50 条 / 周)+ Work / Codex 25–225 条 / 5 小时 | Max 5x(¥980) | 标配,最多用每周额度的 50% |
| Pro $200 = Pro 20x(¥1,990) | 约 200 条 / 周 + 100–900 条 / 5 小时 | Max 20x(¥1,990) | 标配,同样 50% 上限,基数是 Max 5x 的 4 倍 |
| Business / Enterprise | 聊天可选(Enterprise 需管理员开启) | Team / Enterprise | 标准席位同 Pro 规则,premium 席位同 Max 规则 |
两条容易被忽略的规则:Fable 在任何 Claude 套餐里都不是默认模型,Claude Code 里要手动 /model fable(v2.1.255 起); ChatGPT 侧则是买积分不能提前获得访问权,积分只是额度用完后的补充。 人民币价格为 ClaudeMax 当前价,以下单页为准。
API 侧的两个坑
Astra:272K 之后整单翻倍
不是超出部分翻倍,是整个请求按 $20 / $75 计。能切分就切分,能靠缓存复用前缀就复用(缓存读取 $1,仍比重算便宜 10 倍)。 Batch 五折适合离线任务;Fast 模式两倍价换速度,只给真的等不起的交互场景。
Fable 5.1:三条破坏性变更
- 强制 tool_choice(any 或指定工具)会返回 400,靠它约束输出格式的代码要改。
- 旧模型读不了 Fable 5.1 的思考块,做模型回退时要在没有思考块的前提下重新规划。
- 2026 年 8 月 31 日之后创建的 API 账号,编辑更早的对话轮次、系统提示或工具数组会让之后所有思考块失效。
细节与 Claude Code 的配合见 Claude Fable 5.1 发布解读。
更便宜的一层:多数任务的真正主力
| 模型 | 输入 / 输出(每百万) | 订阅里的位置 |
|---|---|---|
| Claude Opus 5 | $5 / $25 | Pro 与 Max 标配,官方建议大多数工作先用它 |
| Claude Sonnet 5 | $2 / $10 | Free 起可用 |
| GPT-5.6 Sol | $4 / $20(7 月 30 日降价后) | Plus 起在聊天里可用 |
| GPT-5.6 Terra / Luna | $2 / $12、$0.20 / $1.20 | API 与 Work / Codex;Luna 是 Free / Go 默认 |
Terminal-Bench 4.0 上 Opus 5 只比两家旗舰低 3–5 个百分点,价格是一半。 合理的用法是把旗舰留给长程 Agent、跨几十个文件的重构和最难的推理,日常问答与常规编码用下一档。
怎么选
| 你的情况 | 建议 |
|---|---|
| 已经在用 Claude Code / Codex 之一,不想换工具链 | 留在原地:两家旗舰能力相当,切换成本比差距大 |
| API 上跑长前缀的 Agent 循环 | Fable 5.1:缓存读取 $0.25 与无长上下文附加费直接反映在账单上 |
| API 上主要是短请求、无缓存 | 两者同价,按基准里你在意的那一项选 |
| 想在聊天里直接用旗舰 | ChatGPT 要 Pro 5x 起,Claude 要 Max 5x 起;Claude Pro 用 Fable 是按 API 价另付 |
| 预算有限 | Opus 5 或 Sol,先证明自己真的需要旗舰再升 |
本文数据截至 2026 年 9 月 9 日,基准均为厂商自报;ChatGPT 聊天入口的每周上限为第三方报道,请以账号内官方提示为准。