模块 11综合实战与故障案例
Coding Agent 实战
从任务理解和仓库约束开始
- 用户目标、范围、非目标和验收
- AGENTS/CONTRIBUTING/架构与测试规范
- 代码图、搜索、依赖和当前工作树
- 已有未提交改动属于用户资产
能力按读、改、执行和协作分级
- 搜索、读取、代码图和历史
- Apply Patch、格式化和代码生成
- 构建、测试、Lint 与受限命令
- 外部文档、Issue/PR 和浏览器验证
- 每类 Tool 有权限、超时和输出摘要
计划随任务复杂度变化
- 简单修复直接定位—改动—验证
- 跨模块任务先建依赖与风险清单
- 明确文件 Owner、接口变化和测试范围
- 新证据推翻假设时局部重规划
编辑保护用户工作和代码边界
- 使用结构化 Patch,避免覆盖无关变更
- 写前重读可能并发变化的文件
- 大规模机械修改与语义修改分离
- 危险 Git/文件操作需要明确授权
验证从最小相关到系统级
- 静态类型、Lint 和目标测试
- 契约、集成、构建或浏览器验收按风险增加
- 失败先归因代码、环境、测试还是既有问题
- 不得把命令退出当成功,必须读断言与产物
执行不可信代码的边界
- 隔离文件、网络、进程和秘密
- 依赖安装和脚本的供应链风险
- 资源、时间和输出大小限制
- 生成 Artifact 扫描后再交付
用户在关键决策点可介入
- 需求歧义和架构取舍
- 扩大范围、破坏性操作和外部写入
- 计划、Diff、测试和残余风险可见
- 用户追加指令时正确合并或替换当前任务
评测 Coding Agent 的真实能力
- 任务完成与测试通过
- 改动最小性、回归和安全
- 步骤、Token、时间和人工干预
- 不同语言、仓库规模、脏工作树和失败环境
- 防止测试集泄漏与只优化补丁命中