目标要可衡量
「帮用户解决问题」太模糊,Agent 会漫无目的地行动。目标应该写成:「在不超过 5 次工具调用内,返回包含 A、B、C 三个字段的结果;无法满足时说明缺少什么。」
可衡量的目标让 Agent 知道何时该停,也让团队知道它做得对不对。
工具要少而准
给 Agent 的工具越多,误用概率越大。每个工具都要写清楚用途、参数、限制和失败返回。工具描述本身就是 Agent 的「文档」。
先把最常用的 3-5 个工具打磨好,再扩展。
- 工具描述:用途、参数、示例、失败情况
- 权限最小化:每个工具只能做它该做的事
- 调用审计:记录每次工具调用的输入输出
循环要有上限
Agent 可能陷入循环:反复调用同一工具、反复请求缺失的参数。工作流必须设置最大步数、超时和成本上限,超限自动转人工或降级。
终止条件不是可选项,是 Agent 安全性的基本要求。
每一步都可回退
Agent 执行的操作(发送消息、修改数据、提交订单)要支持撤销或人工确认。高风险操作默认要人批准。
工作流设计的终点,是让人类在必要时能接管。
第一个 Agent 别做太复杂
第一个 Agent 只给三个工具、一个目标、一个终止条件,跑通后再逐步加。复杂 Agent 的调试成本会指数级上升,一开始就追求全能,大概率收不了尾。
把每个工具的输出都记录下来,出问题时你能回放 Agent 的每一步决策,而不是对着黑盒猜。
工具的失败重试
Agent 调用工具失败时,不能简单重试同一个调用:先判断失败原因。参数错误要修正参数,服务不可用要等待重试,数据不存在要换策略。
给工具调用加「失败原因分类」,让 Agent 根据分类决定下一步,比盲目重试三遍更能解决问题。
同时限制同一工具的连续失败次数,防止 Agent 在一个错误循环里空转。
工具描述怎么写
工具描述要包含五要素:用途、输入参数、输出格式、失败情况、示例调用。描述越具体,Agent 选错工具的概率越低。
写完描述后,用典型场景实测一遍:Agent 是否选择了正确的工具、参数是否传对、失败时是否知道怎么办。
工具描述是 Agent 的「使用文档」,值得像文档一样认真维护。