这次发了什么
9 月 1 日,Anthropic 同时发布 Claude Fable 5.1 和 Claude Mythos 5.1。平台发布说明的定位是「长时间运行的 agent 编码、知识工作与研究」, 1M token 上下文窗口(默认即最大,全窗口标准计价)、128k 最大输出、始终开启的自适应思考,用 effort 参数控制思考深度。分词器与 Fable 5 相同(Opus 4.7 引入的那一套),比 Opus 4.7 之前的模型多产生约 30% 的 token。
| 模型 | API ID | 给谁 |
|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 | 所有客户:Claude API、Bedrock(anthropic.claude-fable-5-1)、Claude Platform on AWS、Google Cloud、Microsoft Foundry;claude.ai 的 Pro / Max / Team / Enterprise;Claude Code |
| Claude Mythos 5.1 | claude-mythos-5-1 | 仅 Project Glasswing 参与者,通过网络安全验证计划(CVP)与生命科学验证计划(LSVP)准入,目前仅限一批美国组织 |
Fable 5 没有被下线,仍可按 claude-fable-5 调用。两代模型都要求 30 天数据保留,未经 Anthropic 明确授权不能在零数据保留(ZDR)下使用。
强在哪:公告给的数字
公告的基准表拿 Fable 5.1 对比 Fable 5、Opus 5 和 GPT-5.6 Sol,这里只摘两代 Fable 的对比:
| 基准 | Fable 5.1 | Fable 5 |
|---|---|---|
| Terminal-Bench 4.0(agent 编码) | 55.8% | 42.0% |
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% |
| CursorBench 3.2.0 | 73.4% | 70.5% |
| Humanity's Last Exam(无工具) | 60.9% | 57.8% |
| OSWorld 2.0(strict) | 41.7% | 36.1% |
平台文档把提升归纳为六个方向:跨小时的 agent 编码(多文件特性、大型重构与迁移、调试、跨会话代码审查)、文档 / 表格 / 幻灯片类知识工作、多步网络研究、读密集图表与 PDF 内嵌表格的视觉能力、贯穿 1M 窗口的长上下文推理、更可靠的浏览器与桌面操作。多语言表现与 Fable 5 持平。 公告强调的行为变化是「避免走会降低质量的捷径,会去修软件问题的根因」,而且差距在高 effort 档位更大。
订阅用户:谁能用、怎么扣
这是官方帮助中心「Claude Fable models on your plan」的规则,Fable 5 与 5.1 一视同仁:
| 套餐 | Fable 5 / 5.1 | 怎么计费 |
|---|---|---|
| Free | 不可用 | — |
| Pro | 可选 | 不含在套餐用量内,从第一条消息起按 usage credits 扣(标准 API 价) |
| Max 5x / 20x | 标配 | 每周用量上限的 50% 以内不额外收费,从同一个每周池扣且扣得更快;超过后开 credits 继续或换模型 |
| Team 标准席位 / Enterprise 标准席位 | 可选 | usage credits |
| Team premium / Enterprise premium 席位 | 标配 | 同 Max 的 50% 规则 |
| Enterprise 按用量计费 | 可选 | 标准 API 价 |
两处容易误读:第一,「50%」不是额外送你一半额度,而是同一个每周池里最多一半可以花在 Fable 上;第二,7 月 20 日 Fable 5 从「全员可用」改成现在这套规则时,Pro 和 Team 标准席位拿到过一次性补偿额度,帮助中心这次明确写了 Fable 5.1 没有对应的补偿。
usage credits 是什么
Pro、Max 5x、Max 20x 都能开:claude.ai 的 Settings › Usage 里 Enable,绑定支付方式后预付,按标准 API 价计费,可以设月度花费上限或 unlimited,也可以设余额低于阈值自动充值,每日兑换上限 $2,000。 对 Opus / Sonnet 来说 credits 只在套餐额度用完后才开始扣(5 小时窗口的额度到期重置);对 Pro 上的 Fable 来说则是从头就扣,因为它根本不在套餐额度里。credits 覆盖网页对话、Claude Code 终端、Research 与项目文件;手机 App 只能用、不能开。
对国内用户的实际含义:想不按 token 付费地用 Fable 5.1,只有 Max。Pro 上按 $10 / $50 的 API 价扣 credits,一次长 agent 任务几十美元并不夸张,而且还需要能在 claude.ai 上完成的海外支付。 通过 ClaudeMax 微信支付开通 Max 5x 或 20x 后,Fable 5.1 在网页端、Claude Code 和 Cowork 里都按上面的 50% 规则可用,无需再单独充值。
API:价格与三条破坏性变更
| 模型(美元 / 百万 token) | 输入 | 5 分钟缓存写 | 1 小时缓存写 | 缓存读 | 输出 | Batch 输入 / 输出 |
|---|---|---|---|---|---|---|
| Fable 5.1 | $10 | $12.50 | $20 | $0.25 | $50 | $5 / $25 |
| Fable 5 | $10 | $12.50 | $20 | $1 | $50 | $5 / $25 |
| Opus 5 | $5 | $6.25 | $10 | $0.50 | $25 | $2.50 / $12.50 |
| Sonnet 5 | $2 | $2.50 | $4 | $0.20 | $10 | $1 / $5 |
缓存读取按基础输入价的 0.025 倍计(其他模型 0.1 倍),长 agent 会话反复读同一段前缀时只付 Fable 5 的四分之一。缓存写入价格和 512 token 的最小可缓存长度不变。Sonnet 5 的 $2 / $10 已确认为长期价格,原定 9 月 1 日的涨价取消。
从 Fable 5 迁移要改的三处
- 强制工具调用不再支持:
tool_choice为any或tool返回 400,auto与none不变(token 计数端点同样校验)。原因是思考始终开启,强制调用会跳过思考、把推理写进工具参数。要 schema 合规的 JSON,用auto加strict: true,或改用结构化输出;要它必须调工具,在提示里点名。 - 思考块绑定到产出它的模型:Fable 5.1 能读 Opus 5、Fable 5、Mythos 5 和更早模型的思考块,反过来不行;请求里带着目标模型读不了的块时 API 静默丢弃(不计费),加
thinking-binding-controls-2026-08-01beta 头会在input_transformations里报告。 - 编辑历史会作废后续思考块:改了
system、tools或更早的消息,下一次请求就报「The block is bound to a different conversation」(2026-08-31 起新建的账号强制执行,老账号只记录不动作,除非你显式设置prefix_mismatch_behavior)。Claude Code、claude.ai、Managed Agents 和 Agent SDK 会替你保持前缀不变;自己拼 messages 的集成要改成只追加:临时指令用会话中系统消息(可加clear_at: "next_user_message"只管一轮),裁剪上下文用服务端 context editing 或 compaction。
五条新增
- 会话中改 effort(beta 头
mid-conversation-output-config-2026-07-01):在 messages 里插一条role: "system"、content: []、带output_config.effort的消息,从下一轮起生效且不打掉缓存;Opus 5 也支持。 - 单轮系统消息(beta 头
mid-conversation-system-clear-at-2026-08-21):clear_at: "next_user_message"的系统消息只对当前轮有系统提示权威,之后留在历史里但不再渲染、不占 token。 - 工具调用之间的进度更新(beta 头
thinking-display-updates-2026-08-18):thinking.display: "updates"把模型在工具调用间写的简短进度作为文本返回,推理本身仍隐藏。 - 缓存读取降价(上表)。
- 内容溯源:Fable 5.1 / Mythos 5.1 生成的文本在所有平台都带 Anthropic 的统计水印;通过代码执行工具产出的图片、视频、音频经 Files API 取回时带 C2PA 凭证。不改变输出、不加 token、不含你的信息。
不改代码也会看到的行为变化
- 并行工具调用更不稳定:Fable 5 会一次批量发的独立读取,5.1 可能一轮只发一个,多花轮次和时间但不影响质量——在 agent 循环的提示里加一句批量调用的指令。
- 长工具运行期间的进度文字更少,尤其高 effort;要叙述就明确要求开场、周期性更新和收尾。
loweffort 下更常凭记忆作答、少调搜索;需要新信息的轮次把 effort 提上去。- 某些场景下文字更密、聊天里更少用加粗和列表、摘要文档时更容易不加引号地复述原文、改文本文件时更倾向整文件重写。官方的 Prompting Claude Fable 5.1 指南对每一条都给了提示词修法。
拒绝与回退
它带和 Fable 5 相同类别的安全分类器,可能返回 HTTP 200 加 stop_reason: "refusal",stop_details 里点名触发的策略领域。回退可以用服务端 fallbacks: "default"(beta,按类别重试到 Anthropic 推荐的模型)、SDK 中间件或自己重试;Fable 5.1 允许的回退目标是 Opus 4.8 和 Opus 5。输出前就被拒的请求不计费,回退时的缓存切换成本由 fallback credit 退还。
Claude Code:怎么开、怎么扣
- 版本:Fable 5.1 要求 v2.1.255+(Fable 5 要求 v2.1.170+),
claude update。 - 不是默认:官方原话「在任何套餐或供应商上都不是账户类型的默认模型」,要手动
/model fable或claude --model fable。别名fable从 v2.1.255 起解析为 Fable 5.1(可用ANTHROPIC_DEFAULT_FABLE_MODEL钉住);best在你能用 Fable 时指向最新 Fable、否则同opus;opus和sonnet在 Anthropic API 上分别是 Opus 5 与 Sonnet 5。Fable 5 要按完整 IDclaude-fable-5选。 - 选择器可能不显示:Anthropic API 上
/model列表只在服务端报告你的组织可用后才列出 Fable;直接打字选会单独向服务端确认,所以列表没有也可能成功。v2.1.260 修了「组织可用但选择器不显示 Fable 5.1」的问题,同时修了工具结果之后附加上下文没被缓存、以及/effort中途切换打掉缓存这两个 5.1 特有的问题;1M 模型的自动压缩也改成在接近上限前触发。 - usage credits 同意框:套餐不含 Fable 时,
/model里那一行标「Requires usage credits」,交互式会话第一次会弹同意框,可以继续用 Fable 扣 credits,也可以切回默认模型;选择器里关掉就保持当前模型,会话中途关掉则本轮用默认模型继续;同意一次后不再弹。Remote Control、后台会话和 agent team 成员会话里没人在终端时,同意框等dialogExpiry(默认 5 分钟),超时就不发这条请求、下条消息再问。-p和 Agent SDK 从不弹框,会直接扣 credits。 - 安全分类器命中时(多见于网络安全和生物领域)自动回退到别的模型,Claude Code 的 automatic model fallback 机制处理。
- 当顾问用:
/advisor fable让 Sonnet 主模型在决策点咨询 Fable,只在关键节点付 Fable 的价;需要先通过/model fable接受过 credits 同意,否则 Claude Code 不会保存 Fable 为顾问。Fable 做主模型时只能配 Fable 顾问。
官方给 Fable 的四条用法建议:描述结果而不是步骤(配合 /goal 让它一直朝结果推进);把根因排查、故障调试、架构决策这类模糊问题交给它;别再反复提醒它测试和检查,它自己会验证;把平时要拆开的任务整个交给它,它撑得住长会话。
该不该用它
官方「Choosing a model」的顺序很明确:大多数工作从 Opus 5 开始,默认 effort 是 high,按 evals 上下调;只有在 Opus 5 拉到 xhigh 或 max 仍达不到要求的高难推理和长时程 agent 工作上,才换 Fable 5.1。 它的定位表述是「持续数小时的 agent 会话、多步深度研究、从头做到成品文档 / 表格 / 幻灯片的分析」。
换算一下:API 上 Fable 5.1 是 Opus 5 的两倍价;Max 用户不用算钱但要算额度,Fable 扣得快,且只有一半额度可花在它身上。合理的分工是把 Sonnet 5 留给日常、Opus 5 留给复杂编码与审查、Fable 5.1 只在长任务开头或 Opus 5 卡住时上,或者干脆用 Sonnet 主模型 + Fable 顾问的搭配。
安全防护这次改了什么
公告的数字是:网络安全防护的误报比之前少 60%,Fable 5.1 与 Fable 5 的生物防护对良性请求的触发少 85%。分流规则仍在:生命科学研发类请求转 Opus 系列处理;渗透测试、漏洞利用生成、基于二进制的漏洞扫描也转 Opus。放开的一项是软件漏洞发现,但不能开发对应的利用代码。 面向企业客户的 Enterprise Frontier Safeguards 在同一天预告,用于让符合条件的客户在更弱的防护级别下使用。