先给结论:Opus 5 是一次可以直接升级的 Opus 更新
Anthropic 于 2026-07-24 发布 Claude Opus 5。官方将它描述为更主动、更审慎的模型,在复杂编程、知识工作和长时间 Agent 任务上明显强于 Opus 4.8,同时保持相同的基础 API 价格。发布信息可查看 Anthropic Opus 5 官方公告。
对网页端用户,最重要的变化是:Opus 5 成为 Claude Max 的默认模型,也是 Claude Pro 当前能力最强的可选模型。对开发者,API 模型名为 claude-opus-5。
Opus 5 主要升级了什么
| 能力 | 实际变化 | 适合任务 |
|---|---|---|
| 长任务执行 | 更能保持目标、主动补足步骤并持续迭代 | 大型重构、持续研究、业务自动化 |
| 代码与调试 | 更重视根因、测试和修改后的验证 | 难复现 bug、跨模块问题、代码审查 |
| 知识工作 | 复杂分析、表格、金融和专业文档更稳定 | 研究报告、数据分析、尽调 |
| 视觉输出 | 界面、演示文稿和交互作品质量提升 | 原型、前端页面、Slides |
| 自我检查 | 更愿意验证假设、运行测试并修正结果 | 高风险交付和上线前检查 |
价格、Effort 和 Fast mode 怎么理解
截至 2026-07-27,Opus 5 的 Claude API 基础价格为每百万输入 Token 5 美元、每百万输出 Token 25 美元,与 Opus 4.8 相同。订阅版的 Pro、Max 费用和 API 按量计费是两套体系,不能直接换算。
- 低 Effort:适合格式转换、摘要、明确问答和低风险修改。
- 中高 Effort:适合调试、研究、代码审查和需要多步推理的任务。
- 最高 Effort:留给架构决策、困难迁移和失败成本高的任务。
- Fast mode:约为默认速度的 2.5 倍,官方平台价格为基础价格的两倍;适合时间敏感而且确实需要 Opus 质量的任务。
选择原则很简单:先用满足质量要求的最低 Effort,只在结果不够稳或任务风险更高时向上调。最高档并不适合作为所有请求的默认值。
五类最值得用 Opus 5 的任务
- 跨模块复杂 bug:现象与根因不在同一个文件,需要读调用链、日志和测试。
- 大型代码迁移:框架升级、数据库迁移、权限改造或多服务协议变更。
- 关键代码审查:支付、认证、订单、数据一致性和安全相关变更。
- 开放式研究:资料较多、结论需要交叉验证,并且最终要形成可审计报告。
- 长时间 Agent:需要连续使用浏览器、终端、文件或其他工具,把任务从计划推进到验收。
哪些任务继续用 Sonnet 5
Opus 5 更强,不等于每次都应该使用。解释一段代码、调整样式、补一组常规测试、整理会议记录和生成固定格式内容,Sonnet 5 通常更快、更经济。一个实用分工是:
- Sonnet 5 负责探索、日常执行和批量处理。
- Opus 5 负责复杂计划、困难决策、根因分析和最终审查。
- 任务出现两次无效修改,或者影响支付、账号、权限和数据时,提前切 Opus 5。
从 Opus 4.8 升级前的检查清单
- 保留一组真实任务作为回归样本,不要只比较主观回答。
- 记录成功率、Token、耗时、工具调用次数和人工修改量。
- 先沿用现有提示词,再判断是否需要缩短过度详细的约束。
- 重新测试安全分类器可能触发的任务和回退行为。
- API 调用改为
claude-opus-5后,先灰度一部分流量。 - 为长任务保留阶段性产物和明确验收条件,避免只看最终文字总结。
安全分类器和模型回退要注意什么
Opus 5 继续使用安全分类器。官方说明,在 Claude 网页、Claude Code 和 Cowork 中,部分被分类器标记的请求会默认回退到 Opus 4.8;API 也可以启用 automatic fallbacks。模型发生回退时,输出风格和能力可能变化,因此关键工作流应记录实际响应模型,而不是假定每次都是 Opus 5。
最终建议
已经使用 Opus 4.8 的用户,可以优先把复杂编程、研究和长任务迁移到 Opus 5 做对照测试。普通 Pro 用户不需要每次都手动切换,遇到 Sonnet 5 难以完成的任务再使用 Opus 5 即可。Claude Code 用户可以继续阅读 Opus 5 长任务与代码审查工作流。