模块 4规划、执行与多 Agent

Agent Harness

Harness 是模型能力的工程外骨骼

  • Runner 与 Loop
  • Tool 注册、执行与策略
  • Context、Session 与检查点
  • Tracing、Eval Hook 和人工中断
  • 业务目标与领域决策仍属于具体 Agent

三种常见 Harness 形态

进程内 SDK/Library

  • 低延迟、易嵌入,但语言和进程耦合

独立 Agent Runtime Service

  • 集中治理,但网络和多租户复杂

控制面 + 数据面

  • 策略、Registry、评测集中,执行面按场景分布
  • 组织规模和隔离需求决定形态,不追求一步到位

稳定接口围绕责任边界

  • Model Adapter 和能力探测
  • Tool Contract 与 Executor
  • State Store、Event Store 和 Artifact Store
  • Policy Decision、Approval 和 Telemetry Exporter

Hook 是观测和扩展点,不是隐式业务流程

  • Run/Step/Model/Tool 前后事件
  • Hook 顺序、失败语义和超时必须明确
  • 关键状态变更不能依赖 Best-effort Hook
  • 插件代码需要权限和资源隔离

全局、租户、Agent 和 Run 配置分层

  • 覆盖优先级和不可覆盖安全底线
  • 能力开关与版本锁定
  • 动态配置变更对在途 Run 的影响
  • 配置快照进入 Trace 但排除秘密

Harness 失败的常见原因

  • 抽象过早导致最小公分母
  • 隐藏 Provider 特性和错误语义
  • 把业务逻辑散落到回调和 Prompt
  • 升级框架时无法回归或迁移

用代表性任务验证 Harness

  • 单 Agent、多 Tool、审批、长任务和 Subagent
  • 可替换 Provider 而不丢关键能力
  • 故障注入下状态、Trace 和恢复一致
  • 开发者完成 Golden Path 的时间与逃逸需求