先给结论:Opus 5 是一次可以直接升级的 Opus 更新

Anthropic 于 2026-07-24 发布 Claude Opus 5。官方将它描述为更主动、更审慎的模型,在复杂编程、知识工作和长时间 Agent 任务上明显强于 Opus 4.8,同时保持相同的基础 API 价格。发布信息可查看 Anthropic Opus 5 官方公告

对网页端用户,最重要的变化是:Opus 5 成为 Claude Max 的默认模型,也是 Claude Pro 当前能力最强的可选模型。对开发者,API 模型名为 claude-opus-5

Opus 5 主要升级了什么

能力实际变化适合任务
长任务执行更能保持目标、主动补足步骤并持续迭代大型重构、持续研究、业务自动化
代码与调试更重视根因、测试和修改后的验证难复现 bug、跨模块问题、代码审查
知识工作复杂分析、表格、金融和专业文档更稳定研究报告、数据分析、尽调
视觉输出界面、演示文稿和交互作品质量提升原型、前端页面、Slides
自我检查更愿意验证假设、运行测试并修正结果高风险交付和上线前检查

价格、Effort 和 Fast mode 怎么理解

截至 2026-07-27,Opus 5 的 Claude API 基础价格为每百万输入 Token 5 美元、每百万输出 Token 25 美元,与 Opus 4.8 相同。订阅版的 Pro、Max 费用和 API 按量计费是两套体系,不能直接换算。

  • 低 Effort:适合格式转换、摘要、明确问答和低风险修改。
  • 中高 Effort:适合调试、研究、代码审查和需要多步推理的任务。
  • 最高 Effort:留给架构决策、困难迁移和失败成本高的任务。
  • Fast mode:约为默认速度的 2.5 倍,官方平台价格为基础价格的两倍;适合时间敏感而且确实需要 Opus 质量的任务。

选择原则很简单:先用满足质量要求的最低 Effort,只在结果不够稳或任务风险更高时向上调。最高档并不适合作为所有请求的默认值。

五类最值得用 Opus 5 的任务

  1. 跨模块复杂 bug:现象与根因不在同一个文件,需要读调用链、日志和测试。
  2. 大型代码迁移:框架升级、数据库迁移、权限改造或多服务协议变更。
  3. 关键代码审查:支付、认证、订单、数据一致性和安全相关变更。
  4. 开放式研究:资料较多、结论需要交叉验证,并且最终要形成可审计报告。
  5. 长时间 Agent:需要连续使用浏览器、终端、文件或其他工具,把任务从计划推进到验收。

哪些任务继续用 Sonnet 5

Opus 5 更强,不等于每次都应该使用。解释一段代码、调整样式、补一组常规测试、整理会议记录和生成固定格式内容,Sonnet 5 通常更快、更经济。一个实用分工是:

  • Sonnet 5 负责探索、日常执行和批量处理。
  • Opus 5 负责复杂计划、困难决策、根因分析和最终审查。
  • 任务出现两次无效修改,或者影响支付、账号、权限和数据时,提前切 Opus 5。

从 Opus 4.8 升级前的检查清单

  1. 保留一组真实任务作为回归样本,不要只比较主观回答。
  2. 记录成功率、Token、耗时、工具调用次数和人工修改量。
  3. 先沿用现有提示词,再判断是否需要缩短过度详细的约束。
  4. 重新测试安全分类器可能触发的任务和回退行为。
  5. API 调用改为 claude-opus-5 后,先灰度一部分流量。
  6. 为长任务保留阶段性产物和明确验收条件,避免只看最终文字总结。

安全分类器和模型回退要注意什么

Opus 5 继续使用安全分类器。官方说明,在 Claude 网页、Claude Code 和 Cowork 中,部分被分类器标记的请求会默认回退到 Opus 4.8;API 也可以启用 automatic fallbacks。模型发生回退时,输出风格和能力可能变化,因此关键工作流应记录实际响应模型,而不是假定每次都是 Opus 5。

最终建议

已经使用 Opus 4.8 的用户,可以优先把复杂编程、研究和长任务迁移到 Opus 5 做对照测试。普通 Pro 用户不需要每次都手动切换,遇到 Sonnet 5 难以完成的任务再使用 Opus 5 即可。Claude Code 用户可以继续阅读 Opus 5 长任务与代码审查工作流