模块 11综合实战与故障案例

Coding Agent 实战

从任务理解和仓库约束开始

  • 用户目标、范围、非目标和验收
  • AGENTS/CONTRIBUTING/架构与测试规范
  • 代码图、搜索、依赖和当前工作树
  • 已有未提交改动属于用户资产

能力按读、改、执行和协作分级

  • 搜索、读取、代码图和历史
  • Apply Patch、格式化和代码生成
  • 构建、测试、Lint 与受限命令
  • 外部文档、Issue/PR 和浏览器验证
  • 每类 Tool 有权限、超时和输出摘要

计划随任务复杂度变化

  • 简单修复直接定位—改动—验证
  • 跨模块任务先建依赖与风险清单
  • 明确文件 Owner、接口变化和测试范围
  • 新证据推翻假设时局部重规划

编辑保护用户工作和代码边界

  • 使用结构化 Patch,避免覆盖无关变更
  • 写前重读可能并发变化的文件
  • 大规模机械修改与语义修改分离
  • 危险 Git/文件操作需要明确授权

验证从最小相关到系统级

  • 静态类型、Lint 和目标测试
  • 契约、集成、构建或浏览器验收按风险增加
  • 失败先归因代码、环境、测试还是既有问题
  • 不得把命令退出当成功,必须读断言与产物

执行不可信代码的边界

  • 隔离文件、网络、进程和秘密
  • 依赖安装和脚本的供应链风险
  • 资源、时间和输出大小限制
  • 生成 Artifact 扫描后再交付

用户在关键决策点可介入

  • 需求歧义和架构取舍
  • 扩大范围、破坏性操作和外部写入
  • 计划、Diff、测试和残余风险可见
  • 用户追加指令时正确合并或替换当前任务

评测 Coding Agent 的真实能力

  • 任务完成与测试通过
  • 改动最小性、回归和安全
  • 步骤、Token、时间和人工干预
  • 不同语言、仓库规模、脏工作树和失败环境
  • 防止测试集泄漏与只优化补丁命中