模块 2Tool 与 Agent Runtime

Tool 发现与选择

Tool 越多,描述竞争越严重

  • 近义能力导致误选
  • 长定义消耗 Context 并稀释指令
  • 未授权 Tool 即使不调用也会扩大攻击面
  • 动态可用性让静态清单过时

可发现性依赖结构化元数据

  • 能力域、动作、资源类型和标签
  • 租户、角色、环境和地域可见性
  • 副作用、风险、成本和延迟等级
  • 版本、Owner、健康状态和废弃信息

候选集分阶段收窄

确定性过滤先行

  • 身份权限
  • 环境与租户
  • 数据域
  • 运行状态

词法/语义召回

  • 用户目标与 Tool 描述
  • 历史任务和领域上下文

重排与多样性控制

  • 适用条件
  • 副作用和成本
  • 避免同类 Tool 占满 Top-K
  • 只注入完成当前步骤所需的定义

无法可靠区分时不要猜

  • 通过澄清问题补齐关键参数
  • 先调用只读发现 Tool
  • 用确定性路由处理高风险能力
  • 记录候选和落选理由供评测

动态 Tool 的信任和缓存

  • 远端发现结果需要来源认证
  • 能力变化用 TTL、版本或通知失效
  • Schema 更新不能破坏正在运行的 Run
  • 健康探测失败时从候选集中摘除而非让模型试错

评测召回与决策两个阶段

  • 正确 Tool 是否进入 Top-K
  • 模型是否在候选中选对或正确不调用
  • 近义、无匹配、越权和失效 Tool 样本
  • Context Token、延迟和缓存命中率