规格与价格:一张表

项目GPT-6 AstraClaude Fable 5.1
发布2026-09-032026-09-01
API 模型 IDgpt-6-astraclaude-fable-5-1
上下文窗口1,050,000 token1,000,000 token(默认即最大)
最大输出128,000128,000
输入 / 输出(每百万 token)$10 / $50$10 / $50
缓存读取$1$0.25
缓存写入$12.50$12.50(5 分钟)/ $20(1 小时)
长上下文规则超过 272K 输入:整单 2 倍输入价、1.5 倍输出价全窗口标准价,无附加费
输入 / 输出模态文本 + 图像 / 文本文本 + 图像 / 文本
推理控制effort:low 到 max自适应思考始终开启,effort 控制深度
知识截止2026-04-30官方未在发布页标注

看账单的人应该盯住两行:缓存读取长上下文规则。 Agent 任务的典型形态是同一份系统提示、工具定义和文档前缀被几十次重复送入,这部分几乎全走缓存读取——Fable 5.1 的 $0.25 对 Astra 的 $1 是 4 倍差。 Anthropic 自己给的数字是典型负载比 Fable 5 省约 25%,高度 Agent 化的任务省到 45%。 而 Astra 的 272K 门槛意味着「把整个代码库塞进去」这件事要付 $20 / $75 的价格, 实操建议见下文「API 侧的两个坑」。

基准:只有一项能直接对比

两家都只公布自己跑的数字,且各自挑基准。把两边都出现的那一项单独拎出来:

Terminal-Bench 4.0(Agent 编程)成绩数据来源
GPT-6 Astra57.9%OpenAI 自报
Claude Fable 5.155.8%Anthropic 自报
Claude Opus 552.3%Anthropic 自报
GPT-5.6 Sol37.3%两家均有,数字一致

结论很朴素:两家旗舰在误差范围内,而且 Opus 5 离它们也不远;真正被甩开的是上一代的 Sol。 Anthropic 发布页的其余对比(同一口径下 Fable 5.1 / Opus 5 / Sol):CursorBench 3.2.0 为 73.4% / 70.0% / 67.2%, AutomationBench 为 31.4% / 26.9% / 19.6%,GDPval-AA v2 知识工作为 1853 / 1824 / 1711,Terminal-Bench-Science 为 52.6% / 29.0% / 22.4%。 OpenAI 侧则强调 FrontierMath Tier 4 97.6%(Sol 83.0%)、OSWorld 2.0 72.6%(Sol 65.7%)。 注意 OSWorld 2.0 两家用的评分口径不同(Anthropic 分 partial 77.9% 与 strict 41.7%),不要把 72.6% 和它们放在一行比。

还有一个影响读数的细节:Anthropic 明确说 Fable 5.1 是开着生产环境安全防护评测的,防护介入的任务直接记零分。 这让它的数字偏保守,也说明你在真实使用中遇到的行为和榜单一致。

安全边界:两家都有「用不了」的场景

  • Astra 是 OpenAI 首个越过 Preparedness Framework「Critical」网络安全阈值的模型。公开版本拒绝高级攻防任务,完整能力只给 Daybreak 可信访问计划里的防御方;ChatGPT 里的安全监控可以暂停运行,API 里可以直接终止被标记的任务。
  • Fable 5.1 与 Mythos 5.1 是同一个模型、不同防护级别。这次防护做了调整:Claude Code 用户的网络安全误拦截平均少约 60%,可以用它发现软件漏洞但不能开发利用程序。
  • 文本水印:Anthropic 对 2026 年 8 月 2 日之后发布的模型输出加了统计学水印,并在小范围预览检测 API。写公开内容的人要知道这一点,境内发布的标识义务见 标识办法实操

订阅里怎么用:这才是多数人的真实差别

你的套餐GPT-6 Astra你的套餐Claude Fable 5.1
Free / Go聊天里没有;Codex 里额度极小Free不可用
Plus(¥185)只在 Work / Codex,5 小时约 5–45 条Pro(¥249)能选,但不含在套餐里,按 API 价扣 usage credits,5.1 没有补偿额度
Pro $100 = Pro 5x(¥920)聊天里的 GPT-6 Pro(第三方报道约 50 条 / 周)+ Work / Codex 25–225 条 / 5 小时Max 5x(¥980)标配,最多用每周额度的 50%
Pro $200 = Pro 20x(¥1,990)约 200 条 / 周 + 100–900 条 / 5 小时Max 20x(¥1,990)标配,同样 50% 上限,基数是 Max 5x 的 4 倍
Business / Enterprise聊天可选(Enterprise 需管理员开启)Team / Enterprise标准席位同 Pro 规则,premium 席位同 Max 规则

两条容易被忽略的规则:Fable 在任何 Claude 套餐里都不是默认模型,Claude Code 里要手动 /model fable(v2.1.255 起); ChatGPT 侧则是买积分不能提前获得访问权,积分只是额度用完后的补充。 人民币价格为 ClaudeMax 当前价,以下单页为准。

API 侧的两个坑

Astra:272K 之后整单翻倍

不是超出部分翻倍,是整个请求按 $20 / $75 计。能切分就切分,能靠缓存复用前缀就复用(缓存读取 $1,仍比重算便宜 10 倍)。 Batch 五折适合离线任务;Fast 模式两倍价换速度,只给真的等不起的交互场景。

Fable 5.1:三条破坏性变更

  • 强制 tool_choice(any 或指定工具)会返回 400,靠它约束输出格式的代码要改。
  • 旧模型读不了 Fable 5.1 的思考块,做模型回退时要在没有思考块的前提下重新规划。
  • 2026 年 8 月 31 日之后创建的 API 账号,编辑更早的对话轮次、系统提示或工具数组会让之后所有思考块失效。

细节与 Claude Code 的配合见 Claude Fable 5.1 发布解读

更便宜的一层:多数任务的真正主力

模型输入 / 输出(每百万)订阅里的位置
Claude Opus 5$5 / $25Pro 与 Max 标配,官方建议大多数工作先用它
Claude Sonnet 5$2 / $10Free 起可用
GPT-5.6 Sol$4 / $20(7 月 30 日降价后)Plus 起在聊天里可用
GPT-5.6 Terra / Luna$2 / $12、$0.20 / $1.20API 与 Work / Codex;Luna 是 Free / Go 默认

Terminal-Bench 4.0 上 Opus 5 只比两家旗舰低 3–5 个百分点,价格是一半。 合理的用法是把旗舰留给长程 Agent、跨几十个文件的重构和最难的推理,日常问答与常规编码用下一档。

怎么选

你的情况建议
已经在用 Claude Code / Codex 之一,不想换工具链留在原地:两家旗舰能力相当,切换成本比差距大
API 上跑长前缀的 Agent 循环Fable 5.1:缓存读取 $0.25 与无长上下文附加费直接反映在账单上
API 上主要是短请求、无缓存两者同价,按基准里你在意的那一项选
想在聊天里直接用旗舰ChatGPT 要 Pro 5x 起,Claude 要 Max 5x 起;Claude Pro 用 Fable 是按 API 价另付
预算有限Opus 5 或 Sol,先证明自己真的需要旗舰再升

本文数据截至 2026 年 9 月 9 日,基准均为厂商自报;ChatGPT 聊天入口的每周上限为第三方报道,请以账号内官方提示为准。