Claude Opus 5 提示工程:少写流程,多给边界
Claude Opus 5 提示工程:少写流程,多给边界
适合谁: 正在把 Claude 用进代码、研究、文档或 Agent 工作流的个人与团队。
先说结论: 不要再把“多想一遍、多检查一遍”机械写进每个提示词。对 Opus 5,更有价值的是把 思考强度、回答篇幅、任务边界与委派规则 分开设定。
这次要改的,不是 Prompt 长度
Anthropic 在 Opus 5 的官方提示工程指南中给出了一个清晰变化:模型在复杂的长链路任务中更容易主动推进,但也更可能输出过长、过度复核,或者在不需要时扩展任务范围。
因此,旧式“写得越细越安全”的系统提示不应原样迁移。更好的做法是:给足业务背景与交付目标,同时只在真正影响成本、范围或安全边界的地方加约束。
1. 先用 high,再用你的评测往下调
effort 控制的是模型思考的投入,而不是最终文字的多少。官方建议从默认的 high 开始,在自己的任务集上测试 low 与 medium 是否已能保持质量;只有高难编程、复杂推理或长链路 Agent 工作才升级到 xhigh。
实用判断:
| 工作类型 | 建议起点 | 你要验证什么 |
|---|---|---|
| 改写、摘要、常规问答 | low / medium | 事实遗漏与格式稳定性 |
| 日常代码生成、分析、写作 | high | 交付完整性与返工次数 |
| 多文件改造、复杂 Agent、疑难推理 | xhigh | 是否带来足以覆盖成本的增益 |
不要把上一代模型的 effort 配置照抄过来。先跑一轮自己的任务评测,成本优化才有依据。
2. 想要更短的回答,直接说“短”
降低 effort 不一定会让可见回答变短,它首先减少的是思考投入。若面向用户的输出需要更简洁,应该把篇幅要求写进提示:结论优先、解释默认给高层摘要、不要用重复的免责声明填充篇幅。
对要落盘的报告、Markdown 或方案,也要单独规定长度标准:覆盖关键事实即可,不以模板段落和重复总结凑篇幅。
3. 清理重复验证,但不要取消必要验收
Opus 5 会自行发现并修正不少错误。官方明确提示:如果系统中叠加了“最终必须再验证一次”“再派一个 Agent 复核”等泛化指令,可能造成过度复核,增加 token 和时间,却没有相应质量收益。
这里的关键不是“从此不验证”,而是把验证从模型的习惯动作,改成外部可观察的验收门槛:
- 代码变更:构建、测试、链接检查、diff 审阅;
- 不可逆动作:部署、删除、权限变更前由人确认;
- 事实型内容:回到一手来源核对,而不是要求模型反复自查。
4. 子 Agent 是并行工具,不是默认步骤
只在任务足够大、子问题真正独立且可以并行时委派。一次可以在少量工具调用内完成的连贯任务,不值得拆成多 Agent;也不应该只为了“再检查一遍”额外生成一个验证 Agent。
一个简单的分界线: 如果每个子任务都依赖上一个结论,就先让一个主 Agent 把事情做完;只有多文件排查、多个独立来源研究等并行轨道,才有委派价值。
5. 把“做到哪儿”为模型写清楚
能力更强的 Agent 也更容易替你扩大范围。对窄任务,提示里要明确:按要求交付、在范围内自行做常规判断;只有出现真正的范围变化、不可逆操作或必须由人提供的信息时才停下请求确认。
这比罗列一长串“不许做什么”更稳定。你真正需要定义的不是每一步路径,而是任务的围栏。
可以立即检查的四处
- 将“重复复核 / 必须再派 Agent 验证”从通用系统提示中移除,改为构建、测试与人工审批等外部验收条件。
- 在用户界面或文档模板中明确输出长度,而不是通过降低 effort 控制篇幅。
- 为常见工作流建立
low、medium、high的小型评测集,按实际质量和成本校准。 - 把子 Agent 的触发条件写成“独立、规模足够、可并行”,并设置数量上限。
来源与边界
本文是基于官方文档的中文编辑总结,不是官方翻译。具体 API 参数、成本和模型能力,请以 Anthropic 最新文档为准。