Opus 5.5 Playbook 转写:三点差异、长任务引导与结果检查

Anthropic 官方 Opus 5.5 Playbook 的转写版:与现有 Claude 用法兼容,差异在三点;并给出提问方式、Claude Code 长任务引导、结果检查的具体做法。

上手 Opus 5.5 之后,最直观的感受是那个曾经很强的 Opus 回来了:文字表达、逻辑深度和响应速度都回到了应有的水平。以下内容整理自 Anthropic 官方的 Opus 5.5 Playbook,与现有的 Claude 使用方式保持兼容,差异集中在三点:模型能独立工作更久;会用自己的话说明做过什么;每次作答前先思考,思考多深由模型自行决定。

一、提问方式

把「完成」定义清楚,然后放手让它自己跑。 在一条消息里交代完整任务与终点,例如「所有测试通过」或「所有接口迁移完毕」,并说明出现什么情况才需要停下来问你。Opus 5.5 进步最明显的地方正是多步骤长任务。

删掉「仔细想想」「一步步思考」这类提示。 模型本身就会先思考,去掉这些话之后回复更快,质量没有明显下滑。需要简短回答时,直接写「直接回答」即可。在 Claude Code 里想调节思考深度,改 effort 设置。

任务执行过程中可以随时补充要求。 现在任务跑得更久,推倒重来的代价更高,想到什么直接输入就行。

做设计时,把不要的风格具体列出来。 「不要太普通」这种笼统说法没有作用,要点名具体样式,例如米白背景、标题中的斜体强调词、「01 / 02 / 03」编号、胶囊形按钮。

二、在 Claude Code 里引导长任务

在 CLAUDE.md 中写清楚何时停、何时继续。 无需你介入的步骤就继续执行;只有卡住,或涉及删数据、强制推送这类破坏性操作时才停下来询问。破坏性命令的权限提示要保持开启。

大任务交给子代理(subagent)并行处理,例如审计、迁移、代码库级别的审查。每个子代理返回结果后,先让它核实证据再决定是否采纳,最后汇总成一张表。

任务清单落在文件里(例如 TASKS.md),边做边勾。上下文被压缩之后清单依然存在,查看文件就能掌握进度。

三、检查结果

先看它需要你做什么,比如尚未确定的决策、等你批准的改动,然后再读其他总结内容。

在人工审查之前,先让它自己审一遍代码。 有早期测试者反馈,Opus 5.5 在最低 effort 下找到的 bug 比 Opus 5 在高 effort 下更多,误报也更少。

做研究分析时,让它标出没能确认的内容,并说明查过哪些地方。

使用 Opus 5.5 的正确姿势,是把它当作能自主执行的同事,而不是一问一答的工具。你的重心会从一步步指挥,转到定目标、设停止规则、最后审核。更长时间的自主任务会越来越普遍,这套「交代目标 → 放手执行 → 先看待办再验收」的流程值得尽早用熟。

分享 微博

弹幕

还没有弹幕,来说一句。

到此一游

共 0 条

还没有人留下足迹,来签个到。

    评论 共 0 条

      昵称 —