解读/深度/opus-5-5-guide
已核对|来源Addy Osmani09-23 · 约 12 分钟

Claude Opus 5.5 使用指南:从交代任务到验收结果

按一次任务的实际顺序,学会写完成标准、控制 Claude Code 长任务、核查交付物,并处理模型切换与速度设置。

⚡ musen · 关键看点与实战指引
  • 突破核心: 经实测验证,彻底解决以往技术栈的复杂配置与链路损耗,提供标准化端到端交互。
  • 落地场景: 适合日常敏捷开发、架构设计、自动化生产力工作流与独立超级个体效率放大。
  • 成本门槛: 0 门槛开箱即用,支持轻量本地自建或标准 API 挂载,无隐藏收费。
Claude Opus 5.5 使用指南:从交代任务到验收结果

Claude Opus 5.5 使用指南:从交代任务到验收结果

按一次任务的实际顺序,学会写完成标准、控制 Claude Code 长任务、核查交付物,并处理模型切换与速度设置。

把 Claude 用在大型代码修改或复杂工作上时,很多人会把任务切成一小步一小步,反复问“继续吗”,再加一句“仔细思考”。这些做法原本是为了防止任务跑偏;面对更能持续执行的 Opus 5.5,却可能把本可连贯完成的工作切断。

Anthropic 的这份使用指南观察到三个变化:Opus 5.5 比前代更能推进多步骤长任务;每次回复前会自行决定思考量;结束时更清楚地说明做了什么、发现了什么、还需要你处理什么。与其一路催步骤,更有用的是在开始时讲清整项任务、完成标准和必须停下来的条件,运行中补充真正新增的要求,结束后核对证据和产物。

“放手让它跑”有边界:删除数据、强制推送、修改仓库外文件等难以撤销的操作,仍要保留停顿规则和权限确认;模型汇报做完了,也要检查测试、改动和未确认事项。

想先了解 Opus 5.5 的能力、表现和价格,可以从站内已发布的模型介绍读起;本文继续讲怎样把它用于实际任务。

一、 核心心智模型与初次尝试的三件事

驾驭 Opus 5.5 的首要变化不是掌握更复杂的提示词技巧,而是减少低效的人工干预。在与它的第一次会话中,Anthropic 建议优先尝试以下三件事:

  1. 交出整项任务并讲清终点:在单条消息中给出完整任务目标,明确说明“怎样才算完成”,以及“在什么情况下停下来询问”,然后让它自主运行。
  2. 删掉“仔细思考”等提示词:Opus 5.5 在每次回复前已经内置深度思考,并会自行评估所需的计算量,无需再手动添加思维催促词。
  3. 长任务结束时,先看它需要你做什么:当漫长的执行告一段落,第一眼先找模型抛出的卡点或需要你决策的事项,确认没有阻塞项后再去通读改动摘要。

二、 如何提问:组织提示词与边界约束

在发起任务前,需要调整以往与旧模型的对话习惯。按 Anthropic 的说明,Opus 5.5 相比前代最大的提升在于多步骤复杂工作(例如在大型代码仓库中端到端推进一项重构直至测试全部通过)。

1. 一次性讲清“全貌”、“完成线”与“停顿条件”

  • 做什么:将整项任务组织在单条提示词中一次性下发。明确说明什么时候才算“完成”(Finish line),并交代哪些情况必须停下来向你提问。
  • 为什么有效:早期测试者反馈,在少有人工干预的情况下,Opus 5.5 可以连续运行编程任务数小时。给予它清晰的终点线,它能自主排错直到达成目标;清晰的完成线也让你在事后能明确核对它有没有真正做完。
  • 实操示例(适用于 Claude Code):

Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is
deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.

中文对照与结构拆解:

  1. 整体任务:将支付端点从旧客户端迁移到新客户端。
  2. 完成标准(Done means):每个端点均接入新客户端、旧客户端代码已彻底删除、测试套件全部通过。
  3. 停顿条件(Stop and ask):仅在测试失败且原因无法解释时,才停下来问我。

这三条完成标准对应三项可检查的结果:逐个端点确认已使用新客户端,确认旧客户端不再留在仓库中,最后查看测试套件的运行结果。若测试失败且原因仍说不清,模型应把失败现象和已检查的线索交给你,而不是把“代码已改”当作完成。

图 A:单条提示词明确整项任务、完成线与停顿条件 图 A:单条提示词明确整项任务、完成线与停顿条件(Anthropic 官方示例)

2. 彻底删除“仔细思考”(think hard / think step by step)

  • 做什么:从你的提示词、系统指令或项目预设配置中,删除诸如 think carefully(仔细思考)、think step by step(一步一步思考)等语句。
  • 为什么有效:Opus 5.5 本身具备内置深度思考能力,会在生成回复前自动决定思考深度。Anthropic 指出,在一款聊天产品的具体测试中,删除一条“think carefully”指令后,回复开始得更早,且未见质量出现明确下降;这是一项具体测试观察,不代表所有任务都能获得同等提速。
  • 如何调控思考:
    • 如果只是需要简单问题的快速回复,直接在提示词中加上:Answer directly(直接回答)。
    • 在 Claude Code 终端中,如需调节整体思考深度,可通过调整系统的 effort(计算投入度)参数进行配置。

3. 运行中途有遗漏?直接敲回车追加指令

  • 做什么:当任务已经在终端跑起来后,如果你突然想起某个约束或遗漏细节,不必为此中断任务推倒重来。直接在终端中输入补充说明并按 Enter。
  • 为什么有效:由于 Opus 5.5 单次任务用时较长,重新启动的成本显著提高。Claude Code 支持在模型工作期间接收补充消息。
  • 实操示例:在模型持续工作时直接输入:Also keep the old endpoint names as aliases.(顺便把旧的端点名称保留为别名)。

4. 设计类需求:逆向列出“不要的样式清单”

m
musen@musen9527

不上班研究僧musen · 真实为底,讲透为骨,人话为形。专注 AI 突破、Coding Agent、自动化全栈实操工程。

在 X 上关注↗

继续探索更多前沿实操

深度
3 天做完 18 个镜头:Higgsfield 动画团队怎样把 AI 放进传统动画流程
让 Claude 帮你搭三维场景、清掉穿帮物体、合成镜头和调色,做完还留下能继续改的工程。Higgsfield 这套制作技能能接手哪些工作,需要准备什么?
深度
Claude Code effort 实战指南:什么时候用 Low,什么时候该升档
先弄清 effort 改变了哪些工作,再看三组开发实测,最后用需求访谈、快速实现、人工评审和深入验证四步选档。
深度
Claude Opus 5.5 写代码画出一支手绘 MV:拆解做法,教你用开源模板自己做
推特用户 NotinReality 把歌词和音频交给 Claude Opus 5.5,它写 JavaScript 逐帧画出一支 156 秒的水彩手绘 MV,全程没用生图或生视频模型。本文拆解两轮生成的差别、模型怎么分章节并行干活,再手把手教你用作者开源的 ClaudeAnimationBase 做自己的动画。