在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的能力
摘要
Anthropic 发布了一份实用指南,介绍如何在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的能力,内容涵盖如何将完整任务交给模型并明确完成标准、删掉“think carefully”这类提示语(因为模型在回复前总会自行推理),以及如何引导长时间的自主编码运行。
暂无内容
查看缓存全文
缓存时间: 2026/10/03 20:28
# 在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的潜力
Source: https://claude.dev/blog/getting-the-most-out-of-opus-5-5/
Opus 5.5 与你现有的 Claude 使用习惯配合良好。不过有几处表现有所不同:它能自主工作更长时间,会直白地告诉你它做了什么,并且每次回复前都会思考。本指南介绍如何在 Claude 应用和 Claude Code 中使用 Opus 5.5,包括如何向该模型下达指令、引导长时间运行以及检查你的结果。
## 先试试这些
**第一次使用 Opus 5.5 时要做的三件事**
1. 把整个任务交给它。说清楚“完成”是什么样子,以及你希望它在什么时候停下来提问。然后放手让它去做。
2. 删掉那些“仔细思考”之类的句子。Opus 5.5 在每次回复前本来就会思考。
3. 当一次长时间运行结束后,先看它需要你做什么。
## 1. 如何提问
### 说清楚“完成”是什么样子,然后放手让它跑
**怎么做。**用一条消息给出整个任务。指明终点,比如“测试全部通过”或“所有端点都完成迁移”。然后就让它去跑。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 在长时间的多部分工作上比 Opus 5 跑得更久、更稳。与之前的 Opus 模型相比,它最大的提升在于多步骤工作,比如推动一项变更贯穿整个大型代码库直到测试通过。早期测试者让它在几乎没有人工监督的情况下连续运行编码任务数小时。有了清晰的终点,它就知道自己什么时候算完成了。
**怎么做。**例如在 Claude Code 中:
PROMPT
```
Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.
```
该示例提示被拆分为三个带标签的框:整个任务(将支付端点从旧客户端迁移到新客户端)、高亮显示的终点(每个端点都使用新客户端、旧客户端被删除、测试套件全部通过),以及何时停下来(仅当某个测试因你无法解释的原因失败时)。页脚:“用一条消息给出整个任务。指明终点。然后别管它。”**图 A**一条消息:整个任务、终点和何时停下来。
### 别再要求它“认真思考”
**怎么做。**从你的提示词和已保存的指令中删掉“仔细思考”“逐步思考”之类的句子。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 每次回复前都会思考,并且由它自己决定思考多少。你不需要要求它思考。我们在一个聊天产品中测试发现,删掉“仔细思考”这句话后,回复开始得更快,质量也没有明显下降。
**怎么做。**删掉那句话。如果只是想快速得到简单问题的答案,就直说:“直接回答。”在 Claude Code 中要改变它的思考程度,请调整 effort。
### 在运行中途补充内容
**怎么做。**如果你在运行中途想起什么,可以在它工作时输入一条后续消息。
**为什么这在 Opus 5.5 上很重要。**现在运行时间更长了,因此重启的代价更高。
**怎么做。**在 Claude Code 中,趁 Claude 工作时输入消息并按回车,例如:“另外,把旧端点名称保留为别名。”
### 做设计工作时,说出你不想要的风格
**怎么做。**当你需要一个页面、一个应用或一份文档时,列出你想排除的设计习惯。
**为什么这在 Opus 5.5 上很重要。**在没有设计方向的情况下,Opus 5.5 会退回到几种默认风格上。像“避免看起来太通用”这样的笼统指令,多半只是把一种默认风格换成了另一种。列出具体要避免的样式效果好得多。
**怎么做。**把这些样式点名说出来:
PROMPT
```
Build a personal website with placeholder content.
Don't use a cream or off-white background, italic accent words in headings, numbered "01 / 02 / 03" section labels, monospace labels, or pill-shaped buttons.
```
然后看看它实际选了什么。如果那个你也不喜欢,就把它加进列表再跑一次。
## 2. 在 Claude Code 中引导长时间运行
### 告诉它你希望它在哪些地方停下来
**怎么做。**在你的 CLAUDE.md 文件中写一条简短的规则,说明什么时候停下来提问、什么时候继续做下去。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 会在工作过程中不断向你汇报。在长任务中,它有时会停下来汇报而不是继续往下走:写一份总结,提到了下一步却不去执行;提出可以继续的建议;或者列出几个并不阻碍工作的选项。它会遵循那些明确规定了这些停顿点的指令。同样,你也要明确说出你希望它在哪些地方停顿。
**怎么做。**把下面这段加进 CLAUDE.md,并根据你的项目进行修改:
PROMPT
```
When a step doesn't need my input, keep going. Put status notes in the same message as your next action.
Stop and ask only when you can't continue without me, or before anything destructive: deleting data, force-pushing, or changing anything outside this repository.
```
一张标题为“告诉它你希望它在哪些地方停下来”的 CLAUDE.md 卡片,包含两个框。继续做:如果某一步不需要我输入,就继续,并把状态说明和你的下一个动作放在同一条消息里。停下来提问:仅当没有我就无法继续时,或在执行任何破坏性操作之前:删除数据、强制推送,或修改本仓库之外的任何内容。页脚:“根据你的项目进行修改。对破坏性命令也要保留权限提示。”**图 B**CLAUDE.md 规则:什么时候继续做,什么时候停下来提问。
如果某次运行以“要我继续吗?”结束,就回复“继续”。如果这种情况经常出现,上面这条规则会有所帮助。
“继续做”的规则意味着更少的停顿,所以在任何有风险或难以撤销的操作之前,你自己的检查仍然不可少。上面规则的最后一行就是干这个用的。对破坏性命令也请保留权限提示。
如果是结对编程,你想要的可能是相反的:开始前给出一行计划,结束时做一份简短回顾。那就把这些写进 CLAUDE.md。Opus 5.5 两种方式都会遵循。
### 让它把大任务拆分给子代理
**怎么做。**对于一次审计、一次迁移,或横跨大型代码库的一次审查,让 Opus 5.5 把工作拆分给多个子代理,并逐一核验每个结果。
**为什么这在 Opus 5.5 上很重要。**早期测试者让 Opus 5.5 在长时间的审计和迁移中协调并行的子代理,几乎没有人工监督。
**怎么做。**
PROMPT
```
Audit every service in services/ for the retry bug in the linked issue.
Give each service to its own subagent. When a subagent reports back, check its evidence before you accept it.
Finish with one table: service, affected yes or no, and the evidence.
```
一张标题为“把每个服务交给它自己的子代理”的示意图。提示“审计 services/ 中的每一个服务,查找关联 issue 中的重试 bug”分散扇出到四个子代理。它们的报告汇聚到“核验其证据”这一步(“当子代理汇报后,在接受之前先核验它的证据”),随后一个箭头指向“最后汇总成一张表格”,一张空表格,列分别为:服务、是否受影响(是/否)、证据。**图 C**扇出到子代理,核验每个子代理的证据,最后汇总成一张表格。
### 把任务清单写进文件
**怎么做。**对于一次需要较长时间的运行,让 Opus 5.5 把它的任务清单保存在一个文件里,并随时更新。然后通过阅读该文件、而不是聊天滚动记录,来了解运行进展到哪一步了。
**为什么这在 Opus 5.5 上很重要。**现在的运行时间更长了。一次长运行会填满上下文窗口,Claude Code 随后会总结较早的对话轮次。文件中的清单可以经受住这一点,而且能让你一眼看出哪些已完成、哪些还剩着。
**怎么做。**“在 TASKS.md 中维护一个检查清单。每完成一项就打勾,并把新发现的问题补充进去。”
## 3. 检查结果
### 先读它需要你做什么
**怎么做。**当一次长运行结束后,首先寻找 Claude 正在等你处理的事项,比如它留下的一个待决问题,或希望你批准的一项变更。然后再读 Claude 总结的其余部分。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 对其工作的汇报比 Opus 5 更清晰。它的过程更新和最终总结会用直白的语言说明它做了什么、发现了什么,以及需要你做什么。
**怎么做。**要改变总结的格式,在 CLAUDE.md 中说明即可,例如:“每次运行结束后都用三个标题收尾:待我处理、已改动、已发现。”
### 让它审查代码
**怎么做。**在人工审查之前,先让 Opus 5.5 审查一次 diff 或一个 pull request。
**为什么这在 Opus 5.5 上很重要。**一位早期测试者表示,Opus 5.5 在最低 effort 下捕捉到的 bug 比 Opus 5 在高 effort 下还多,而且误报更少。它还会用直白的语言解释自己的改动,因此它的 pull request 描述更便于审查。
**怎么做。**把这段提示发给 Claude:
PROMPT
```
Review the diff on this branch against main.
List only problems you'd block the merge for. For each one, give the file and line, why it's wrong, and how to show it fails.
```
### 让它标注无法确认的内容
**怎么做。**在调研和分析任务中,让它说出它找不到或无法核实的内容。
**为什么这在 Opus 5.5 上很重要。**“我没能找到这个”是有价值的信息,而明确要求它这样做,会让这些信息很容易被找到。
**怎么做。**在请求中加上“标注任何你无法确认的内容,并说明你在哪里查找过”。这在 Claude 的研究报告中和 Claude Code 中都有效。
## 4. 在 Claude 应用中
首先,确认模型选择器显示的是 Opus 5.5。
**怎么做。**附上图表、示意图、截图或幻灯片,不要把数字重新打一遍。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 读取图表、示意图和截图比 Opus 5 更准确,而且无需额外步骤就能做到。它还更擅长理解依赖于图像中位置关系的含义:某根箭头连接了哪两个方框、一张示意图的两个版本之间有什么变化,或者日历截图中一场会议何时开始、何时结束。
**怎么做。**附上图片并提出一个具体问题:“这些服务中,哪些直接调用了计费 API?”
### 让它检查一份长文档
**怎么做。**给它一份长篇计划、报告或幻灯片,让它找出错误。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 比之前的 Opus 模型更注重细节。在我们的测试中,它在一段很长的规划讨论中发现了一个落在错误星期几的日期,以及一张幻灯片中与数字不符的图表。
**怎么做。**提交这个提示:“检查这份幻灯片中任何自相矛盾的地方:数字、日期和姓名。引用每一处问题,并说明它在哪里。”
### 直接索要成品文件
**怎么做。**当你想要一份表格或文档时,直接要成品文件,而不是一份大纲。
**为什么这在 Opus 5.5 上很重要。**Opus 5.5 制作的表格和文档在分享之前需要的修改比 Opus 5 的更少。
**怎么做。**“把它做成一份我可以分享的表格:每个供应商一行,列出成本、合同结束日期和负责人这几列。”
### 在项目中,说明哪些回答已经定论
**怎么做。**如果长对话中的后续提问让你觉得反应迟缓,就加上一条说明:之前的回答已经定论。
**为什么这在 Opus 5.5 上很重要。**在长对话中,Opus 5.5 在思考一个简短的后续问题时,有时会回头重新审视之前的某个回答。这会拖慢回复速度。
**怎么做。**把下面这段加进项目的指令中:
PROMPT
```
Once you have answered something, treat that answer as done. Focus on what I'm asking now, and don't go back over an earlier answer unless I ask about it or point out a problem with it.
```
但在用于长篇分析的项目中请不要加这条,因为后面的步骤有可能暴露出前面某一步的错误。
## 5. 当消息被标记时
Opus 5.5 是第一款以 Fable 级生物与网络安全防护级别发布的 Opus 模型。在 Claude 应用和 Claude Code 中,大多数被标记的消息会转到一个较旧的模型上,你的工作则在那边继续。在源代码中寻找安全漏洞是允许的,日常的健康和教育类问题也应当正常可用。这些防护措施有时会误伤合法的工作,我们正在调整它们以减少误判。如果你被切换了,下面是你将看到的内容以及应对方法。
### 在 Claude 应用中
**你会看到什么。**一条以“已切换到”开头、后接较旧模型名称的通知。Claude 会在那个模型上作答,对话也会停留在该模型上。
**怎么做。**
- 要回到 Opus 5.5,在模型选择器中选它即可。如果之前的消息仍在对话中,它可能会再次被标记。开一个新对话可以避免这一点。
- 若要求先询问你,前往“设置”,然后是“功能”,关闭“消息被标记时切换模型”。你会看到一张“已暂停”的卡片,上面有你的选项。
检查范围覆盖对话中的所有内容,包括文件和搜索结果。因此标记可能来自更早的内容,而不只是你最后一条消息。
### 在 Claude Code 中
**你会看到什么。**一条指明了较旧模型名称的通知。会话会在该模型上继续。
**怎么做。**
- 运行 /model 切换回去。
- 按两次 Esc 编辑你最后一条消息再试一次。
- 若要求先询问你,运行 /config 并修改“消息被标记时切换模型”。
- 如果标记是误判,运行 /feedback。
### 不要在回复中要求它展示自己的推理过程
**怎么做。**从你的提示词和指令中删掉要求它在回复中重现其内部推理的内容。
**为什么这在 Opus 5.5 上很重要。**要求在回复中重现内部推理的请求可能会被拒绝。这属于被标记的类别之一。
**怎么做。**直接向 Claude 索要你需要的东西,例如:“用三句话解释你为什么选择这个方案。”
## 6. 速度
### 如果每条回复你都要等,就开启快速模式
**怎么做。**在 Claude Code 中,用快速模式处理一来一回的往复工作,也就是你在发送下一条消息前要先读完每条回复的那种工作。
**为什么这在 Opus 5.5 上很重要。**快速模式在 Opus 5.5 发布时作为研究预览提供。你得到的是同一个模型,但文本会更早到达。它需要额外开启相应的用量,并且每个 token 的费用高于标准模式。
**怎么做。**在 Claude 中输入 /fast。
## 你的 Opus 5.5 检查清单
在下一次长任务开始前过一遍这里。
一张检查清单卡片,包含四组复选项目:提问、Claude Code 中的长运行、检查和标记。下列为同样的项目文本。**图 D**检查清单一览。**提问**
- 任务中说清了“完成”是什么样子
- 提示词或已保存的指令中没有“认真思考”之类的句子
- 设计请求中列出了要排除的样式
- 图表和截图是直接附上的,而不是重新打了一遍
**Claude Code 中的长运行**
- CLAUDE.md 说明了何时停下来、何时继续,并规定在任何破坏性操作前停下来
- 对破坏性命令仍保留权限提示
- 大型审计和迁移被拆分给了子代理
- 任务清单被保存在文件中
**检查**
- 先读报告中“需要你处理”的部分
- 在人工审查之前先跑一遍审查
- 调研答案标注了无法确认的内容
**标记**
- 你知道怎么切换回去:模型选择器,或者 /model
- “消息被标记时切换模型”的设置符合你的预期
开始用Opus 5.5 (https://www.anthropic.com/claude-opus-5-5) 构建吧!
*感谢 Molly Vorwerck 的审阅。*
相似文章
@0xwhrrari:Sonnet 5.5 + Opus 5.5 是一套离谱的编码组合 大多数人只是把它当作模型下拉菜单来用 我写了一份 9 页的 PDF,告诉你……
一位 Twitter 用户分享了一份 9 页的 PDF 指南,介绍如何在 Claude Code 中协同调度 Claude Sonnet 5.5 和 Opus 5.5,内容涵盖何时将任务路由给哪个模型、如何减少无谓的 token 消耗,以及如何衡量一项编码任务的真实成本。
提示 Claude Opus 5.5
本指南详细介绍了针对 Claude Opus 5.5 的提示模式,涵盖了与 Claude Opus 5 的行为差异,并提供了努力校准、API 集成和无人值守代理任务的策略。
Claude Code 在大型代码库中的工作原理
Anthropic 的博文详细介绍了在大型复杂代码库中使用 Claude Code 的最佳实践,阐述了代理搜索以及如 CLAUDE.md 文件等扩展的“利用”如何在大规模下提升导航和性能。
@chetaslua: Claude Opus 5.2 当前正在 claude code 内部测试 > opus 5 正在路由到新的 opus 5.2 > 这是一次性测试 < 但 opu…
一位用户报告在 Claude Code 内部测试了 Claude Opus 5.2,注意到 Opus 5 路由到新版本,并表现出类似于特定训练方法的循环行为,无需明确提示。
@bcherny: 人们经常问我,充分利用 Claude Code 的最大秘诀是什么。现在我最重要的建议就是:使用自动模式…
Boris Cherny 推荐在 Claude Code 中使用自动模式来并行执行会话,同时 ClaudeDevs 宣布自动模式现已面向 Pro 计划用户开放,并支持 Sonnet 4.6 和 Opus 4.7。