Chico Notes
AI Engineering

Human-in-the-loop:Agent 什么时候必须停下来问人

设计 Agent 的人工确认点,覆盖高风险操作、低置信度、权限边界、不可逆副作用和业务审批。

持续修订的工程笔记

生产 Agent 不应该追求全自动。真正可靠的系统知道什么时候继续执行,什么时候停下来让人确认。

必须确认的场景

场景原因
删除、支付、发送消息不可逆或外部副作用。
权限提升安全风险高。
低置信度决策证据不足。
多方案取舍需要业务偏好。
合规敏感需要审计记录。

确认请求格式

我准备执行:给客户 C123 发送退款确认邮件。
依据:订单 O456 已退款成功。
风险:邮件发送后不可撤回。
请确认:发送 / 修改 / 取消

结论

Human-in-the-loop 不是体验倒退,而是把不可控风险显式化。好的 Agent 会把人放在关键决策点,而不是每一步都打扰。

讨论

继续讨论这篇笔记

有问题、补充案例或不同观点,可以通过 GitHub Discussions 继续交流。

On this page