返回博客

AI 任务合同的五项最小字段

人工智能5269
AI 任务合同的五项最小字段

AI 任务合同的五项最小字段

给 AI 的指令越长,不一定越清楚。重复角色设定、语气要求和禁止事项会占据篇幅,却没有回答最终交付物是什么、哪些材料可以作为事实、哪些动作需要授权,以及什么证据才能证明任务完成。一个可执行任务可以压缩为五个字段:目标、证据、权限边界、完成条件和停止规则。本文逐项说明字段职责,并给出编码与研究任务模板,使执行者可以自行选择方法,但不能把猜测写成完成结果。

目标:写可观察的交付物

“分析项目”没有结束状态。目标应写明使用者和产物:

text
为维护者输出一份缺陷根因说明,包含复现条件、证据位置和最小修复范围。

目标只描述结果,不提前规定未经调查的根因或实现方式。

证据:列出可以依赖的事实

编码任务可以提供复现步骤、失败命令、首个相关错误、文件路径和接口约束。研究任务可以提供时间范围、允许来源、已有材料和必须回答的问题。

证据与背景不同。项目历史如果不能帮助验证本次结论,就不应默认加入上下文。未提供或无法读取的材料必须标为缺口。

权限边界:区分允许、确认和禁止

将动作分成三组比重复“不要操作”更清楚:

text
允许:读取指定目录、修改范围内文件、运行本地非破坏性测试。
需确认:删除或覆盖文件、扩大范围、访问外部系统、产生费用。
禁止:提交密钥、绕过权限、虚构命令或验证结果。

权限必须由工具和运行环境落实。提示词只能说明协作规则,不能替代账号授权和系统隔离。

完成条件:使用外部证据验收

完成条件应能够由测试、文件或来源检查:

text
原始失败测试转为通过;
相关回归测试没有新增失败;
公共接口字段保持不变;
每条关键事实都引用输入中的来源标识;
生成文件能够由目标程序重新打开。

“模型已经自检”不是证据。无法运行的验证必须列为限制,不得写成通过。

停止规则:定义何时不再继续

停止规则处理三种情况:

  1. 信息不足:列出最小缺口并提问,不自行补齐;
  2. 风险升高:触及范围外文件、外部写入或不可逆动作时暂停;
  3. 重复失败:同类错误达到任务预设次数后保留证据并交给人工。

达到完成条件后也要停止,避免顺手重构或添加未请求功能。

编码任务模板

text
目标:修复〔可观察错误〕,保持〔接口或行为〕不变。

证据:复现步骤为〔步骤〕;失败命令为〔命令〕;相关文件为〔路径〕。

权限边界:可修改〔目录〕并运行本地测试;新增依赖、删除文件、外部写入或扩大范围需确认;禁止修改生产配置。

完成条件:回归测试先因原问题失败;修复后目标测试和相关测试通过;差异只含必要修改。

停止规则:根因位于范围外时报告证据;缺少环境时列出所需信息;不得把未执行测试写成通过。

研究任务模板

text
目标:产出关于〔主题〕的决策简报,回答〔关键问题〕。

证据:限定〔时间与地区〕;优先使用〔一手来源类型〕;已有材料为〔清单〕。

权限边界:只访问公开且有权访问的材料;不绕过登录或访问控制;不把搜索摘要当原始证据。

完成条件:关键结论紧邻来源;事实、推断和判断明确区分;争议与缺口单独列出。

停止规则:核心问题获得足够证据后停止;无法核实的子问题保留缺口,不生成确定结论。

用对照样例验证合同

准备正常输入、缺失输入和越权请求各一个样例。检查正常任务是否产生约定产物,缺失输入是否触发最小问题,越权请求是否在动作发生前停止。修改合同后重新运行相同样例,才能判断删除或新增规则的影响。

结论与限制

最小任务合同通过目标、证据、权限边界、完成条件和停止规则,把执行自由与系统边界分开。它能减少无依据补全和任务外扩张,但不能保证模型正确,也不能代替测试、权限控制或人工审批。

本文结构适用于编码、研究和一般 Agent 任务。具体工具支持哪些结构化字段、系统指令和审批能力会随接口变化,使用前仍需核对当前文档并通过代表性样例验证。

五个字段如何协同工作

五个字段不是五段互相独立的提示词,而是一条从输入到停止的约束链:

text
目标定义交付物
  -> 证据限定可以引用的事实
  -> 权限边界限定可以采取的动作
  -> 完成条件定义如何验收
  -> 停止规则定义何时交还人工

例如“整理一份事故复盘”这个目标,如果没有证据字段,执行者可能把聊天里的猜测写成根因;如果没有权限边界,可能直接修改线上文档;如果没有完成条件,结果只要看起来完整就会被当作交付;如果没有停止规则,缺少日志时仍可能继续推断。字段之间必须互相引用,才能形成可审计的任务合同。

执行前的最小检查

在把合同交给模型或 Agent 前,先由发起人完成一次五项检查:

检查通过标准不通过时的动作
目标读者能从一句话判断交付物改写成可观察结果
证据每条关键事实都有来源位置补材料或标记缺口
权限允许、确认、禁止动作已分组缩小范围并补审批人
完成有测试、文件或来源可以验收增加可观察检查项
停止缺失、冲突和风险升级都有出口写明交还人工的条件

这张表也适合放进代码评审或研究评审的模板中。它的作用不是增加流程,而是在执行前暴露“看起来清楚、实际上无法验收”的字段。

从最小合同到任务复盘

任务结束后不要只保存最终答案,还应记录合同是否需要修改:

text
实际遇到的缺口:缺少哪个证据或字段?
触发的停止条件:模型在哪一步交还人工?
产生的返工:哪些输出需要人工重做?
合同修订:下一次应增加什么前置条件?

如果同一种缺口连续出现,优先修改输入表单或完成条件,而不是继续加长提示词。若问题来自权限或系统能力,应该修改工具配置和审批流程;提示词只能表达约束,不能替代运行环境的隔离。复盘记录还可以作为回归样例,验证新合同没有破坏原有任务。

标签:提示词工程AI Agent任务设计

推荐阅读

探索更多前沿洞察与行业干货。