AI 任务合同的五项最小字段
给 AI 的指令越长,不一定越清楚。重复角色设定、语气要求和禁止事项会占据篇幅,却没有回答最终交付物是什么、哪些材料可以作为事实、哪些动作需要授权,以及什么证据才能证明任务完成。一个可执行任务可以压缩为五个字段:目标、证据、权限边界、完成条件和停止规则。本文逐项说明字段职责,并给出编码与研究任务模板,使执行者可以自行选择方法,但不能把猜测写成完成结果。
目标:写可观察的交付物
“分析项目”没有结束状态。目标应写明使用者和产物:
目标只描述结果,不提前规定未经调查的根因或实现方式。
证据:列出可以依赖的事实
编码任务可以提供复现步骤、失败命令、首个相关错误、文件路径和接口约束。研究任务可以提供时间范围、允许来源、已有材料和必须回答的问题。
证据与背景不同。项目历史如果不能帮助验证本次结论,就不应默认加入上下文。未提供或无法读取的材料必须标为缺口。
权限边界:区分允许、确认和禁止
将动作分成三组比重复“不要操作”更清楚:
权限必须由工具和运行环境落实。提示词只能说明协作规则,不能替代账号授权和系统隔离。
完成条件:使用外部证据验收
完成条件应能够由测试、文件或来源检查:
“模型已经自检”不是证据。无法运行的验证必须列为限制,不得写成通过。
停止规则:定义何时不再继续
停止规则处理三种情况:
- 信息不足:列出最小缺口并提问,不自行补齐;
- 风险升高:触及范围外文件、外部写入或不可逆动作时暂停;
- 重复失败:同类错误达到任务预设次数后保留证据并交给人工。
达到完成条件后也要停止,避免顺手重构或添加未请求功能。
编码任务模板
研究任务模板
用对照样例验证合同
准备正常输入、缺失输入和越权请求各一个样例。检查正常任务是否产生约定产物,缺失输入是否触发最小问题,越权请求是否在动作发生前停止。修改合同后重新运行相同样例,才能判断删除或新增规则的影响。
结论与限制
最小任务合同通过目标、证据、权限边界、完成条件和停止规则,把执行自由与系统边界分开。它能减少无依据补全和任务外扩张,但不能保证模型正确,也不能代替测试、权限控制或人工审批。
本文结构适用于编码、研究和一般 Agent 任务。具体工具支持哪些结构化字段、系统指令和审批能力会随接口变化,使用前仍需核对当前文档并通过代表性样例验证。
五个字段如何协同工作
五个字段不是五段互相独立的提示词,而是一条从输入到停止的约束链:
例如“整理一份事故复盘”这个目标,如果没有证据字段,执行者可能把聊天里的猜测写成根因;如果没有权限边界,可能直接修改线上文档;如果没有完成条件,结果只要看起来完整就会被当作交付;如果没有停止规则,缺少日志时仍可能继续推断。字段之间必须互相引用,才能形成可审计的任务合同。
执行前的最小检查
在把合同交给模型或 Agent 前,先由发起人完成一次五项检查:
| 检查 | 通过标准 | 不通过时的动作 |
|---|---|---|
| 目标 | 读者能从一句话判断交付物 | 改写成可观察结果 |
| 证据 | 每条关键事实都有来源位置 | 补材料或标记缺口 |
| 权限 | 允许、确认、禁止动作已分组 | 缩小范围并补审批人 |
| 完成 | 有测试、文件或来源可以验收 | 增加可观察检查项 |
| 停止 | 缺失、冲突和风险升级都有出口 | 写明交还人工的条件 |
这张表也适合放进代码评审或研究评审的模板中。它的作用不是增加流程,而是在执行前暴露“看起来清楚、实际上无法验收”的字段。
从最小合同到任务复盘
任务结束后不要只保存最终答案,还应记录合同是否需要修改:
如果同一种缺口连续出现,优先修改输入表单或完成条件,而不是继续加长提示词。若问题来自权限或系统能力,应该修改工具配置和审批流程;提示词只能表达约束,不能替代运行环境的隔离。复盘记录还可以作为回归样例,验证新合同没有破坏原有任务。




