模块 2Tool 与 Agent Runtime

Human-in-the-Loop

人工介入不只有“批准/拒绝”

  • 补充缺失信息与消除歧义
  • 复核模型结论或证据
  • 授权高风险动作
  • 接管失败或异常 Run
  • 事后抽检与策略改进

用风险和不确定性触发人工

  • 影响范围、可逆性、金额、数据敏感度和外部承诺
  • 缺少事实、候选冲突、低置信或策略无覆盖
  • 超出步骤、成本、时间或正常行为基线
  • 避免所有动作都审批造成疲劳和橡皮图章

审批者必须看到足够但不过载的信息

  • Agent 计划执行什么、作用于哪个对象
  • 关键参数、差异预览和不可逆后果
  • 使用了哪些证据及其时效
  • 可选修改、拒绝原因和升级路径

审批是可持久化中断

  • 保存待审批动作、状态版本和原始风险判断
  • 恢复时重新验证身份、权限、参数和外部状态
  • 审批只授权特定动作与参数,不是永久通行证
  • 拒绝结果以受控 Observation 回注,避免模型反复申请

长等待需要组织语义

  • 截止时间、提醒、自动撤销或升级
  • 代理审批和职责分离
  • 审批者离职或权限变化
  • Run 取消后未处理审批自动失效

评估人工节点是否真正降低风险

  • 审批量、等待时长和拒绝/修改率
  • 误批、漏批和事后事故
  • 审批者一致性和疲劳信号
  • 哪些规则可自动化、哪些必须保留人工责任