在 ClaudeMax 订阅 Claude:Pro 就含 Claude Code;微信支付,提交 Cookie 后通常 5–30 分钟收到 Anthropic 官方 Team 席位邀请,账号绑定你自己的邮箱。Claude Pro ¥249 / Max 5x ¥980 / Max 20x ¥1,990,价格以下单页为准。买哪档、怎么买 · Pro 还是 Max · 立即下单

这次发了什么

9 月 1 日,Anthropic 同时发布 Claude Fable 5.1 和 Claude Mythos 5.1。平台发布说明的定位是「长时间运行的 agent 编码、知识工作与研究」, 1M token 上下文窗口(默认即最大,全窗口标准计价)、128k 最大输出、始终开启的自适应思考,用 effort 参数控制思考深度。分词器与 Fable 5 相同(Opus 4.7 引入的那一套),比 Opus 4.7 之前的模型多产生约 30% 的 token。

模型API ID给谁
Claude Fable 5.1claude-fable-5-1所有客户:Claude API、Bedrock(anthropic.claude-fable-5-1)、Claude Platform on AWS、Google Cloud、Microsoft Foundry;claude.ai 的 Pro / Max / Team / Enterprise;Claude Code
Claude Mythos 5.1claude-mythos-5-1仅 Project Glasswing 参与者,通过网络安全验证计划(CVP)与生命科学验证计划(LSVP)准入,目前仅限一批美国组织

Fable 5 没有被下线,仍可按 claude-fable-5 调用。两代模型都要求 30 天数据保留,未经 Anthropic 明确授权不能在零数据保留(ZDR)下使用。

强在哪:公告给的数字

公告的基准表拿 Fable 5.1 对比 Fable 5、Opus 5 和 GPT-5.6 Sol,这里只摘两代 Fable 的对比:

基准Fable 5.1Fable 5
Terminal-Bench 4.0(agent 编码)55.8%42.0%
Terminal-Bench-Science 0.152.6%24.7%
CursorBench 3.2.073.4%70.5%
Humanity's Last Exam(无工具)60.9%57.8%
OSWorld 2.0(strict)41.7%36.1%

平台文档把提升归纳为六个方向:跨小时的 agent 编码(多文件特性、大型重构与迁移、调试、跨会话代码审查)、文档 / 表格 / 幻灯片类知识工作、多步网络研究、读密集图表与 PDF 内嵌表格的视觉能力、贯穿 1M 窗口的长上下文推理、更可靠的浏览器与桌面操作。多语言表现与 Fable 5 持平。 公告强调的行为变化是「避免走会降低质量的捷径,会去修软件问题的根因」,而且差距在高 effort 档位更大

订阅用户:谁能用、怎么扣

这是官方帮助中心「Claude Fable models on your plan」的规则,Fable 5 与 5.1 一视同仁:

套餐Fable 5 / 5.1怎么计费
Free不可用
Pro可选不含在套餐用量内,从第一条消息起按 usage credits 扣(标准 API 价)
Max 5x / 20x标配每周用量上限的 50% 以内不额外收费,从同一个每周池扣且扣得更快;超过后开 credits 继续或换模型
Team 标准席位 / Enterprise 标准席位可选usage credits
Team premium / Enterprise premium 席位标配同 Max 的 50% 规则
Enterprise 按用量计费可选标准 API 价

两处容易误读:第一,「50%」不是额外送你一半额度,而是同一个每周池里最多一半可以花在 Fable 上;第二,7 月 20 日 Fable 5 从「全员可用」改成现在这套规则时,Pro 和 Team 标准席位拿到过一次性补偿额度,帮助中心这次明确写了 Fable 5.1 没有对应的补偿

usage credits 是什么

Pro、Max 5x、Max 20x 都能开:claude.ai 的 Settings › Usage 里 Enable,绑定支付方式后预付,按标准 API 价计费,可以设月度花费上限或 unlimited,也可以设余额低于阈值自动充值,每日兑换上限 $2,000。 对 Opus / Sonnet 来说 credits 只在套餐额度用完后才开始扣(5 小时窗口的额度到期重置);对 Pro 上的 Fable 来说则是从头就扣,因为它根本不在套餐额度里。credits 覆盖网页对话、Claude Code 终端、Research 与项目文件;手机 App 只能用、不能开。

对国内用户的实际含义:想不按 token 付费地用 Fable 5.1,只有 Max。Pro 上按 $10 / $50 的 API 价扣 credits,一次长 agent 任务几十美元并不夸张,而且还需要能在 claude.ai 上完成的海外支付。 通过 ClaudeMax 微信支付开通 Max 5x 或 20x 后,Fable 5.1 在网页端、Claude Code 和 Cowork 里都按上面的 50% 规则可用,无需再单独充值。

API:价格与三条破坏性变更

模型(美元 / 百万 token)输入5 分钟缓存写1 小时缓存写缓存读输出Batch 输入 / 输出
Fable 5.1$10$12.50$20$0.25$50$5 / $25
Fable 5$10$12.50$20$1$50$5 / $25
Opus 5$5$6.25$10$0.50$25$2.50 / $12.50
Sonnet 5$2$2.50$4$0.20$10$1 / $5

缓存读取按基础输入价的 0.025 倍计(其他模型 0.1 倍),长 agent 会话反复读同一段前缀时只付 Fable 5 的四分之一。缓存写入价格和 512 token 的最小可缓存长度不变。Sonnet 5 的 $2 / $10 已确认为长期价格,原定 9 月 1 日的涨价取消。

从 Fable 5 迁移要改的三处

  1. 强制工具调用不再支持tool_choiceanytool 返回 400,autonone 不变(token 计数端点同样校验)。原因是思考始终开启,强制调用会跳过思考、把推理写进工具参数。要 schema 合规的 JSON,用 autostrict: true,或改用结构化输出;要它必须调工具,在提示里点名。
  2. 思考块绑定到产出它的模型:Fable 5.1 能读 Opus 5、Fable 5、Mythos 5 和更早模型的思考块,反过来不行;请求里带着目标模型读不了的块时 API 静默丢弃(不计费),加 thinking-binding-controls-2026-08-01 beta 头会在 input_transformations 里报告。
  3. 编辑历史会作废后续思考块:改了 systemtools 或更早的消息,下一次请求就报「The block is bound to a different conversation」(2026-08-31 起新建的账号强制执行,老账号只记录不动作,除非你显式设置 prefix_mismatch_behavior)。Claude Code、claude.ai、Managed Agents 和 Agent SDK 会替你保持前缀不变;自己拼 messages 的集成要改成只追加:临时指令用会话中系统消息(可加 clear_at: "next_user_message" 只管一轮),裁剪上下文用服务端 context editing 或 compaction。

五条新增

  • 会话中改 effort(beta 头 mid-conversation-output-config-2026-07-01):在 messages 里插一条 role: "system"content: []、带 output_config.effort 的消息,从下一轮起生效且不打掉缓存;Opus 5 也支持。
  • 单轮系统消息(beta 头 mid-conversation-system-clear-at-2026-08-21):clear_at: "next_user_message" 的系统消息只对当前轮有系统提示权威,之后留在历史里但不再渲染、不占 token。
  • 工具调用之间的进度更新(beta 头 thinking-display-updates-2026-08-18):thinking.display: "updates" 把模型在工具调用间写的简短进度作为文本返回,推理本身仍隐藏。
  • 缓存读取降价(上表)。
  • 内容溯源:Fable 5.1 / Mythos 5.1 生成的文本在所有平台都带 Anthropic 的统计水印;通过代码执行工具产出的图片、视频、音频经 Files API 取回时带 C2PA 凭证。不改变输出、不加 token、不含你的信息。

不改代码也会看到的行为变化

  • 并行工具调用更不稳定:Fable 5 会一次批量发的独立读取,5.1 可能一轮只发一个,多花轮次和时间但不影响质量——在 agent 循环的提示里加一句批量调用的指令。
  • 长工具运行期间的进度文字更少,尤其高 effort;要叙述就明确要求开场、周期性更新和收尾。
  • low effort 下更常凭记忆作答、少调搜索;需要新信息的轮次把 effort 提上去。
  • 某些场景下文字更密、聊天里更少用加粗和列表、摘要文档时更容易不加引号地复述原文、改文本文件时更倾向整文件重写。官方的 Prompting Claude Fable 5.1 指南对每一条都给了提示词修法。

拒绝与回退

它带和 Fable 5 相同类别的安全分类器,可能返回 HTTP 200 加 stop_reason: "refusal"stop_details 里点名触发的策略领域。回退可以用服务端 fallbacks: "default"(beta,按类别重试到 Anthropic 推荐的模型)、SDK 中间件或自己重试;Fable 5.1 允许的回退目标是 Opus 4.8 和 Opus 5。输出前就被拒的请求不计费,回退时的缓存切换成本由 fallback credit 退还。

Claude Code:怎么开、怎么扣

  • 版本:Fable 5.1 要求 v2.1.255+(Fable 5 要求 v2.1.170+),claude update
  • 不是默认:官方原话「在任何套餐或供应商上都不是账户类型的默认模型」,要手动 /model fableclaude --model fable。别名 fable 从 v2.1.255 起解析为 Fable 5.1(可用 ANTHROPIC_DEFAULT_FABLE_MODEL 钉住);best 在你能用 Fable 时指向最新 Fable、否则同 opusopussonnet 在 Anthropic API 上分别是 Opus 5 与 Sonnet 5。Fable 5 要按完整 ID claude-fable-5 选。
  • 选择器可能不显示:Anthropic API 上 /model 列表只在服务端报告你的组织可用后才列出 Fable;直接打字选会单独向服务端确认,所以列表没有也可能成功。v2.1.260 修了「组织可用但选择器不显示 Fable 5.1」的问题,同时修了工具结果之后附加上下文没被缓存、以及 /effort 中途切换打掉缓存这两个 5.1 特有的问题;1M 模型的自动压缩也改成在接近上限前触发。
  • usage credits 同意框:套餐不含 Fable 时,/model 里那一行标「Requires usage credits」,交互式会话第一次会弹同意框,可以继续用 Fable 扣 credits,也可以切回默认模型;选择器里关掉就保持当前模型,会话中途关掉则本轮用默认模型继续;同意一次后不再弹。Remote Control、后台会话和 agent team 成员会话里没人在终端时,同意框等 dialogExpiry(默认 5 分钟),超时就不发这条请求、下条消息再问。-p 和 Agent SDK 从不弹框,会直接扣 credits
  • 安全分类器命中时(多见于网络安全和生物领域)自动回退到别的模型,Claude Code 的 automatic model fallback 机制处理。
  • 当顾问用/advisor fable 让 Sonnet 主模型在决策点咨询 Fable,只在关键节点付 Fable 的价;需要先通过 /model fable 接受过 credits 同意,否则 Claude Code 不会保存 Fable 为顾问。Fable 做主模型时只能配 Fable 顾问。

官方给 Fable 的四条用法建议:描述结果而不是步骤(配合 /goal 让它一直朝结果推进);把根因排查、故障调试、架构决策这类模糊问题交给它;别再反复提醒它测试和检查,它自己会验证;把平时要拆开的任务整个交给它,它撑得住长会话。

该不该用它

官方「Choosing a model」的顺序很明确:大多数工作从 Opus 5 开始,默认 effort 是 high,按 evals 上下调;只有在 Opus 5 拉到 xhighmax 仍达不到要求的高难推理和长时程 agent 工作上,才换 Fable 5.1。 它的定位表述是「持续数小时的 agent 会话、多步深度研究、从头做到成品文档 / 表格 / 幻灯片的分析」。

换算一下:API 上 Fable 5.1 是 Opus 5 的两倍价;Max 用户不用算钱但要算额度,Fable 扣得快,且只有一半额度可花在它身上。合理的分工是把 Sonnet 5 留给日常、Opus 5 留给复杂编码与审查、Fable 5.1 只在长任务开头或 Opus 5 卡住时上,或者干脆用 Sonnet 主模型 + Fable 顾问的搭配。

安全防护这次改了什么

公告的数字是:网络安全防护的误报比之前少 60%,Fable 5.1 与 Fable 5 的生物防护对良性请求的触发少 85%。分流规则仍在:生命科学研发类请求转 Opus 系列处理;渗透测试、漏洞利用生成、基于二进制的漏洞扫描也转 Opus。放开的一项是软件漏洞发现,但不能开发对应的利用代码。 面向企业客户的 Enterprise Frontier Safeguards 在同一天预告,用于让符合条件的客户在更弱的防护级别下使用。