AI AGENT 协作手册

AI Agent Collaboration · 2026

协作,不是操控。

一套释放 AI Agent 能力,同时守住事实、风险与责任边界的方法。

01 / 角色定位

把 Agent 当成一位高级同事

能力很强、知识面很广,但不了解全部现场,也会偶尔自信地犯错。

你的角色

问题定义者

决定真正要解决什么,以及这件事为什么值得做。

你的角色

边界制定者

明确什么不能碰、哪些风险不可接受、何时必须询问。

你的角色

结果验收者

不听“已经完成”,而是检查验证、证据、例外与剩余风险。

认知升级:你不是“提示词工程师”。你的核心能力是定义问题、分配决策权,并建立验收闭环。

02 / 提案不是万能答案

目标给空间,硬约束给边界。

适合放宽解法空间

告诉它问题与目标

  • 你确定目标,但不确定最佳实现方式
  • 存在多条技术路线,需要调研和权衡
  • 任务跨领域,需要端到端完成
  • 你关心结果,不要求某一种技术
仍应指定实现方式

技术路径本身就是约束

  • 现有系统规定了技术栈、接口或架构
  • 必须兼容既有代码、数据或团队规范
  • 某种方案已被验证,无需重新选型
  • 法规、安全、成本或性能限制很具体
  • 任务只是明确的机械实现
更可靠的原则:不要把尚未验证的个人猜想,误写成不可改变的技术要求。AI 知识面广,不等于一定能找到最优解;它可能缺少组织背景、隐性约束与真实数据。

03 / 核心口诀

我定方向和底线 它定路径 我看证据

方向由我负责。
路径由 Agent 负责。
结论由证据负责。

执行可以外包,责任和判断不能外包。AI 可以研究、比较、实现和测试;你仍要决定问题是否值得解决、风险是否可接受、证据是否足够、结果是否采用。

04 / 四个动作

定方向,划边界;放路径,看证据。

定义最终结果

先问“我希望什么发生改变”,不要只描述一个中间动作。

划清硬边界

说清必须满足、绝不能发生,以及哪些事情要先问你。

释放解法空间

允许 Agent 自主调查、比较、决策和处理低风险可逆问题。

坚持证据验收

检查实际验证、成功标准、事实与假设、失败案例及剩余风险。

05 / 一放一收

方案上放,验收上收。

开始时 · 放 少规定
“怎么做”

提供背景、目标、现实约束和成功标准;给 Agent 研究与选择技术路径的空间。

结束时 · 收 严格检查
“做好没有”

要求实际测试、可复现证据、例外说明和剩余风险,而不是接受一句“应该可以”。

最常见的反面:开始时把实现细节规定得很死,完成后却听 Agent 说一句“已经实现”就接受了。

06 / 输入治理

四类输入,不能混为一谈。

把准备告诉 AI 的内容分成四类。前两类明确锁定;偏好允许权衡;方案猜想只作为线索。

01 / 事实

确认过的信息

例如处理量、真实用户、现有系统与数据位置。无法确认就标记“未知”,不要让 AI 把假设当事实。

准确提供 · 冲突要指出
02 / 硬约束

不可违反

例如数据不能外发、必须输出特定格式、不能动生产库、预算不能超过上限。

没有自由裁量权
03 / 偏好

可以被权衡

例如界面尽量简单、倾向沿用基础设施、最好少加依赖。更优方案可推翻,但要解释理由。

优先满足 · 允许说明后调整
04 / 方案猜想

只是线索

例如“也许可用 NER”“我想到过正则”“或许用某框架”。请 Agent 独立评估。

不要误写成硬要求

07 / 决策契约

完整委托,有六个要素。

01

为什么做

业务意义是什么?不做会怎样?谁正在承受这个问题?

02

想得到什么结果

描述最终状态,而不只是动作。不是“写脚本”,而是“让非技术人员安全地完成工作”。

03

必须满足什么

安全、隐私、兼容性、预算、时间、格式等真正的硬约束。

04

什么不在范围内

例如暂不接生产、不做权限体系、本轮只验证可行性、不对外发送。

05

怎样算完成

给出可检查的成功标准:测试、准确率、Schema 校验、操作步数、性能或错误率。

06

Agent 有什么权限

什么可自行决定、什么要先问、何时停下、最终要交付什么证据。

08 / 授权边界

可逆操作放权,不可逆操作设闸。

可以自主完成

  • 搜索、阅读、分析与比较方案
  • 创建草稿、样例、原型和测试数据
  • 编写代码、运行安全的本地测试
  • 处理普通、低风险、可逆的问题
  • 在授权范围内修正小错误并继续

必须先确认

  • 删除、覆盖或迁移重要数据
  • 对外发送邮件、消息或发布内容
  • 产生费用、交易或法律承诺
  • 扩大系统权限或操作生产环境
  • 接触或外发隐私、密钥、内部资料
  • 关键事实无法确认且会改变方向
边界不是微观管理。它约束的是风险和责任,而不是强行替 Agent 选择每一个实现细节。

09 / 成熟度

Demo 能跑,不等于问题已经解决。

每次委托都应说明当前目标属于哪一级,否则 Agent 很容易用 Demo 能跑,冒充问题已经解决。

1

概念验证

证明核心思路可行,允许大量临时处理。

2

Demo

核心体验可演示,但未必可靠、完整或安全。

3

内部工具

真实人员可有限使用,有明确边界与人工兜底。

4

生产系统

可靠、安全、可维护、可观测,并能处理失败。

5

受监管系统

还需要审计、验证、合规证据与责任链条。

FDA 等高监管场景尤其要区分:做出一个原型,与构建可用于真实申报和患者数据的受监管系统,完全不是同一难度等级。

10 / 日常节奏

从提案启动,到证据收口。

01

给提案,不给施工图

提供背景、目标、约束、范围和成功标准。

02

让 Agent 自主调查

先检查现状和必要资料,比较方案;除非关键信息缺口会显著改变方向,否则不必先问。

03

让它端到端执行

请选择最合适的方案并完成,不要只给教程;普通问题自行处理。

04

只在风险节点设闸

不审批每个技术选择,只审批不可逆、高风险、对外或超权限动作。

05

用验收证据收口

逐项检查成功标准、实际测试、复现方式、失败案例和剩余风险。

11 / 证据式验收

不接受“应该可以”。

实际做了什么
列出真实完成的改动与产物位置。
如何验证
提供执行过的测试、检查方式和真实结果。
成功标准是否逐项满足
不要用整体印象替代逐项验收。
事实与假设是否分开
来源冲突要指出,未知值要留空。
例外与失败案例
主动展示没有通过、尚未覆盖的情况。
剩余风险与恢复方式
说明尚存风险、影响范围及回退路径。

12 / 完整母提示

把它写成一份决策契约。

我的目标是:[希望最终发生什么变化]背景和为什么:[当前情况、痛点、不做的后果、相关用户]已知事实:[确认过的信息;未知或冲突处明确标注]硬约束:[必须满足和绝不能触碰的条件]偏好与方案线索:[可推翻,但请说明理由]本轮范围:[做什么、不做什么;成熟度等级]成功标准:[可检查的验收条件]授权边界:请自主调查、选择方案并端到端完成。普通、低风险、可逆的问题自行处理;不可逆、对外、付费、扩权、敏感数据或关键事实不明时先问我。完成后报告:结果与位置;关键决策;验证与证据;例外和剩余风险;必要时的恢复方式。
我的目标是: [希望最终发生什么变化] 背景和为什么: [当前情况、痛点、不做的后果、相关用户] 已知事实: [确认过的信息;未知或冲突处明确标注] 硬约束: [必须满足和绝不能触碰的条件] 偏好与方案线索: [这些不是硬性要求;如果有更优方案可以推翻,但请说明理由] 本轮范围: [要做什么、不做什么;是概念验证、Demo、内部工具还是生产方案] 成功标准: [可以被检查的验收条件] 授权边界: 请自主调查、选择方案并端到端完成,不要只给操作教程。 普通、低风险、可逆的问题自行处理。 遇到不可逆操作、对外发送、产生费用、扩大权限、涉及敏感数据, 或者关键事实无法确认且会影响方向时,先停下来问我。 完成后请报告: 1. 实际完成的结果与产物位置 2. 关键决策及理由 3. 验证方法、执行过的测试与证据 4. 未解决事项、例外和剩余风险 5. 必要时的恢复或回退方式

13 / 轻量版

日常委托,只要六句话。

我想实现的结果是……

这件事重要,是因为……

必须满足……,绝不能……

做到……就算成功。

请自主选择方案并完成;普通、低风险、可逆的问题自行处理,高风险或不可逆操作前问我。

完成后给我实际验证、证据、例外和剩余风险。

如果你已经想到技术方案:“我想到过……,但这只是线索,不是硬性要求。请独立判断是否存在更好的方案。”

14 / 内化成习惯

开始前问三题,结束后复盘一分钟。

启动前 · 三问
1. 我要的究竟是动作,还是结果?
2. 哪些是真正的底线,哪些只是方案猜想?
3. 看到什么证据,我才相信它完成了?
结束后 · 一分钟复盘
  1. 我是不是规定了太多不必要的实现细节?
  2. Agent 有没有因为缺少背景而走偏?
  3. 我的成功标准是否足够明确?
  4. 我是不是过早相信了未经验证的结论?
  5. 下次哪些内容可以沉淀成固定规则?
问题边界放权执行证据复盘

15 / 底线清单

开放路径,但不放弃事实、风险与验收。

01 / 解法

少管步骤,多给上下文

让 Agent 理解问题、现实背景与目标,允许它在更大的方案空间中比较。

02 / 风险

普通问题自主,高风险设闸

可逆操作充分放权;不可逆、对外、付费、敏感、超权限行为必须确认。

03 / 事实

不确定就暴露,不要补全

未知留空、冲突标注、数字核算、时间语义分开。允许推理,不允许编造。

04 / 完成

没有证据,就没有完成

测试必须实际执行;结果应可复现;例外、失败和风险应透明。

最终原则:约束结果与风险,不约束路径;允许自主决策,但不允许无证据地自信。

结语 / Keep this

先定义问题,
再划清边界;
路径交给 Agent,
结论交给证据。

最短记忆:
我定方向和底线,它定路径,我看证据。

本页呈现模式:
整屏章节 Fullpage Chapters,简称“整屏翻页”——一屏一章、无页内滚轴、滚动/滑动/键盘整页切换。完整呈现规范另行对齐。

01 / 17 协作,不是操控