模块 2Tool 与 Agent Runtime
Human-in-the-Loop
人工介入不只有“批准/拒绝”
- 补充缺失信息与消除歧义
- 复核模型结论或证据
- 授权高风险动作
- 接管失败或异常 Run
- 事后抽检与策略改进
用风险和不确定性触发人工
- 影响范围、可逆性、金额、数据敏感度和外部承诺
- 缺少事实、候选冲突、低置信或策略无覆盖
- 超出步骤、成本、时间或正常行为基线
- 避免所有动作都审批造成疲劳和橡皮图章
审批者必须看到足够但不过载的信息
- Agent 计划执行什么、作用于哪个对象
- 关键参数、差异预览和不可逆后果
- 使用了哪些证据及其时效
- 可选修改、拒绝原因和升级路径
审批是可持久化中断
- 保存待审批动作、状态版本和原始风险判断
- 恢复时重新验证身份、权限、参数和外部状态
- 审批只授权特定动作与参数,不是永久通行证
- 拒绝结果以受控 Observation 回注,避免模型反复申请
长等待需要组织语义
- 截止时间、提醒、自动撤销或升级
- 代理审批和职责分离
- 审批者离职或权限变化
- Run 取消后未处理审批自动失效
评估人工节点是否真正降低风险
- 审批量、等待时长和拒绝/修改率
- 误批、漏批和事后事故
- 审批者一致性和疲劳信号
- 哪些规则可自动化、哪些必须保留人工责任