AI Engineering
Human-in-the-loop:Agent 什么时候必须停下来问人
设计 Agent 的人工确认点,覆盖高风险操作、低置信度、权限边界、不可逆副作用和业务审批。
生产 Agent 不应该追求全自动。真正可靠的系统知道什么时候继续执行,什么时候停下来让人确认。
必须确认的场景
| 场景 | 原因 |
|---|---|
| 删除、支付、发送消息 | 不可逆或外部副作用。 |
| 权限提升 | 安全风险高。 |
| 低置信度决策 | 证据不足。 |
| 多方案取舍 | 需要业务偏好。 |
| 合规敏感 | 需要审计记录。 |
确认请求格式
我准备执行:给客户 C123 发送退款确认邮件。
依据:订单 O456 已退款成功。
风险:邮件发送后不可撤回。
请确认:发送 / 修改 / 取消结论
Human-in-the-loop 不是体验倒退,而是把不可控风险显式化。好的 Agent 会把人放在关键决策点,而不是每一步都打扰。
讨论
继续讨论这篇笔记
有问题、补充案例或不同观点,可以通过 GitHub Discussions 继续交流。