在 ClaudeMax 订阅 Claude:Pro 就含 Claude Code;微信支付,提交 Cookie 后通常 5–30 分钟收到 Anthropic 官方 Team 席位邀请,账号绑定你自己的邮箱。Claude Pro ¥249 / Max 5x ¥980 / Max 20x ¥1,990,价格以下单页为准。买哪档、怎么买 · Pro 还是 Max · 立即下单

支柱一:可验证——从提示语到无人值守的四级阶梯

「Claude 在工作看起来完成时停下」——没有检查,它只能靠「看起来」。官方给出的修法是层层加码的四级:

层级做法适合
Prompt 内把测试用例 / 验证命令写进任务,要求跑完再报今天任何任务都能用
/goal 条件独立评估器每轮复查目标是否达成,未达成继续干跨多轮的会话级目标
Stop hook脚本化检查不过就不许结束回合(连续 8 次拦截后强制放行)确定性门禁
验证子智能体全新上下文的模型试图推翻结果——干活的不给自己打分无人值守长任务收尾

配套要求:让 Claude 出示证据而不是宣称成功——测试输出、跑过的命令与返回、结果截图。 看证据比你重跑验证快,而且对你没盯着的会话同样有效。三组官方改写示例照抄即可: 「实现邮箱校验函数」改成「写 validateEmail,测试用例 a@b.com 为真 / invalid 为假,实现后跑测试」; 「把仪表盘做好看点」改成「按这张截图实现,完成后截图对比列出差异并修掉」; 「构建挂了」改成「构建报这个错:[贴错误],修复并验证构建通过,解决根因不要压制报错」。

支柱二:探索 → 规划 → 实现 → 提交

  1. 探索:Shift+Tab 进 plan 模式(或 claude --permission-mode plan),让 Claude 读 /src/auth、理解会话与登录如何处理——只读不改。
  2. 规划:「我要加 Google OAuth,哪些文件要动?会话流怎么走?出个方案」。Ctrl+G 把方案开进编辑器直接改。
  3. 实现:批准方案退出 plan 模式,「按方案实现,给 callback handler 写测试,跑通并修掉失败」。
  4. 提交:描述性 commit + 开 PR。

官方同时泼了盆冷水:plan 模式有开销。改错字、加日志、重命名这类一句话能描述 diff 的任务直接干; 规划的价值在方案不确定、跨多文件、代码不熟这三种情形。

大特性的进阶版:让 Claude 采访你

我要做 [特性简述]。用 AskUserQuestion 工具详细采访我。
问技术实现、UI/UX、边界情况、隐患和取舍。别问显而易见的,
挖我可能没想过的难点。问透之后把完整规格写进 SPEC.md。

规格写完开一个全新会话执行:干净上下文专注实现,规格文件随时可查。好规格自包含: 点名涉及的文件与接口、写明什么不在范围内、以端到端验证步骤收尾。

支柱三:上下文是你的根本约束

  • 无关任务之间 /clear:官方失败模式清单第一名就是「大杂烩会话」。
  • 纠正两次法则:同一问题纠正超过两次,上下文已被失败尝试污染——/clear 重开 + 融入教训的更好 prompt,几乎总是更快。
  • 调研外包给子智能体:「用子智能体调查我们的鉴权怎么处理 token 刷新」——读几百个文件的消耗发生在别的上下文里,只有摘要回来。
  • 部分摘要:Esc+Esc 选中某条消息,「从这里开始摘要」或「摘要到这里为止」——比全量 /compact 更外科手术。
  • 教 compaction 保命:CLAUDE.md 里写「压缩时永远保留修改过的文件清单与测试命令」。
  • CLAUDE.md 本身要瘦:写太长 Claude 会忽略一半——「不写这条它也做对的,删掉或改成 hook」。

会话是持久且可逆的:用足这两个属性

  • 检查点:每条 prompt 自动存档,Esc+Esc 或 /rewind 可单独回滚对话、单独回滚代码、或两者都回。官方直接建议用它支撑激进试错——先试大胆方案,不行回滚换路。警告也要记住:只覆盖 Claude 编辑工具的改动,Bash 与外部进程的修改不入快照,不能替代 git。
  • 会话即分支:/rename 起名(如 oauth-migration),claude --continue 续上次、--resume 挑历史——跨天任务不用重新交代背景。

规模化:Writer / Reviewer 与对抗性收尾

并行的具体形态(worktree、agent view、teams)我们有专文;最佳实践页补的是质量向的多会话用法: 全新上下文审代码不会偏袒自己刚写的东西。Writer / Reviewer 模式——A 会话实现限流器,B 会话审 @src/middleware/rateLimiter.ts 找边界与竞态,A 拿反馈修;测试同理,一个写测试、另一个写实现来通过。

收尾的对抗性审查给了现成 prompt,关键在最后一句防过度工程:

用子智能体对照 PLAN.md 审查限流器的 diff。检查每条需求都已实现、
列出的边界情况有测试、任务范围之外没有东西被改动。
报告缺口,不报风格偏好。

官方特意提醒:被要求找缺口的审查者总会找出点什么——逐条照办会走向过度工程。 只处理影响正确性与既定需求的发现,其余当可选项。

五种失败模式速查

模式修法
大杂烩会话(任务混飞)无关任务间 /clear
反复纠正同一问题两次不中就重开 + 更好的初始 prompt
过度膨胀的 CLAUDE.md狠删;已经做对的指令删掉或转 hook
信任但不验证没有验证手段的改动不要发布
无边界的「调查一下」收窄范围,或丢给子智能体隔离消耗

原文结尾一节叫「培养直觉」,立场值得转述:这些模式是起点不是铁律——有时就该让上下文累积(深挖一个复杂问题时), 有时就该跳过规划(探索型任务),有时模糊的 prompt 恰恰对(想看 Claude 如何理解问题)。留意什么有效、追问为什么失效, 指南教不了的部分靠这个长出来。