模块 4规划、执行与多 Agent
Agent Harness
Harness 是模型能力的工程外骨骼
- Runner 与 Loop
- Tool 注册、执行与策略
- Context、Session 与检查点
- Tracing、Eval Hook 和人工中断
- 业务目标与领域决策仍属于具体 Agent
三种常见 Harness 形态
进程内 SDK/Library
- 低延迟、易嵌入,但语言和进程耦合
独立 Agent Runtime Service
- 集中治理,但网络和多租户复杂
控制面 + 数据面
- 策略、Registry、评测集中,执行面按场景分布
- 组织规模和隔离需求决定形态,不追求一步到位
稳定接口围绕责任边界
- Model Adapter 和能力探测
- Tool Contract 与 Executor
- State Store、Event Store 和 Artifact Store
- Policy Decision、Approval 和 Telemetry Exporter
Hook 是观测和扩展点,不是隐式业务流程
- Run/Step/Model/Tool 前后事件
- Hook 顺序、失败语义和超时必须明确
- 关键状态变更不能依赖 Best-effort Hook
- 插件代码需要权限和资源隔离
全局、租户、Agent 和 Run 配置分层
- 覆盖优先级和不可覆盖安全底线
- 能力开关与版本锁定
- 动态配置变更对在途 Run 的影响
- 配置快照进入 Trace 但排除秘密
Harness 失败的常见原因
- 抽象过早导致最小公分母
- 隐藏 Provider 特性和错误语义
- 把业务逻辑散落到回调和 Prompt
- 升级框架时无法回归或迁移
用代表性任务验证 Harness
- 单 Agent、多 Tool、审批、长任务和 Subagent
- 可替换 Provider 而不丢关键能力
- 故障注入下状态、Trace 和恢复一致
- 开发者完成 Golden Path 的时间与逃逸需求