模块 2Tool 与 Agent Runtime
Tool 发现与选择
Tool 越多,描述竞争越严重
- 近义能力导致误选
- 长定义消耗 Context 并稀释指令
- 未授权 Tool 即使不调用也会扩大攻击面
- 动态可用性让静态清单过时
可发现性依赖结构化元数据
- 能力域、动作、资源类型和标签
- 租户、角色、环境和地域可见性
- 副作用、风险、成本和延迟等级
- 版本、Owner、健康状态和废弃信息
候选集分阶段收窄
确定性过滤先行
- 身份权限
- 环境与租户
- 数据域
- 运行状态
词法/语义召回
- 用户目标与 Tool 描述
- 历史任务和领域上下文
重排与多样性控制
- 适用条件
- 副作用和成本
- 避免同类 Tool 占满 Top-K
- 只注入完成当前步骤所需的定义
无法可靠区分时不要猜
- 通过澄清问题补齐关键参数
- 先调用只读发现 Tool
- 用确定性路由处理高风险能力
- 记录候选和落选理由供评测
动态 Tool 的信任和缓存
- 远端发现结果需要来源认证
- 能力变化用 TTL、版本或通知失效
- Schema 更新不能破坏正在运行的 Run
- 健康探测失败时从候选集中摘除而非让模型试错
评测召回与决策两个阶段
- 正确 Tool 是否进入 Top-K
- 模型是否在候选中选对或正确不调用
- 近义、无匹配、越权和失效 Tool 样本
- Context Token、延迟和缓存命中率