先划边界,再给 Agent 工具

用职责、权限和停止条件控制智能体,避免能调用工具却不能可靠交付。

3 分钟阅读免费公开

给 Agent 增加浏览器、代码仓库、邮件或数据库工具很容易。困难的是确保它只在正确的时间,以正确的权限完成正确的动作。

工具越多,不确定性越大。设计顺序应该从边界开始,而不是从工具清单开始。

职责要同时写正面和反面

“负责客户运营”过于宽泛。更可执行的描述是:

负责:整理每日客户反馈,归类问题并生成处理建议。
不负责:直接承诺退款、修改合同、对外发送未经审核的回复。

反面边界可以阻止 Agent 把“帮助推进”理解成“代替负责人决策”。

把权限拆成三个层级

读取

允许获取完成任务所需的信息,但要限制数据范围。读取权限仍然可能暴露个人信息、密钥和内部材料。

建议

Agent 可以生成方案、草稿和变更预览,但不改变外部状态。新流程应优先从这一层开始。

执行

只有动作可恢复、目标明确并且验收充分时,才开放写入。付款、删除、发布和对外发送等高影响动作应保留人工确认。

写出明确的停止条件

以下情况应该停止并请求人工处理:

  • 输入之间存在冲突;
  • 缺少会改变结果的业务选择;
  • 需要扩大数据访问范围;
  • 即将执行不可恢复的动作;
  • 连续尝试后仍无法验证结果。

停止不是失败。一个知道何时停下来的 Agent,比一个永远“继续尝试”的 Agent 更适合进入真实业务。

用真实交付物验收

不要只测 Agent 是否给出了回答。应检查它能否在真实输入中保持权限边界、输出可用结果,并在异常条件下正确停止。

先把边界跑通,再逐步增加工具。这样得到的是可控能力,而不是功能数量。

方法看懂了,还需要落到你的业务里?

从一个真实问题开始。贝有科技提供 AI 实战问题解决、工作系统诊断和内容试产服务。

查看实战服务