第 5 章:工具选型与综合任务 — 选择合适的工作台¶
📋 本章概览¶
| 项目 | 内容 |
|---|---|
| 学习时长 | 10 分钟 |
| 核心概念 | GUI、CLI、IDE、Agent、MCP、验收 |
| 核心比喻 | 不同 Agent 是不同工作台,关键是任务和边界匹配 |
| 实践任务 | 完成一次受控的代码问题诊断 |
| 难度等级 | ★★★☆☆ |
选工具先看任务,不先看排行榜¶
不同 Agent 工具的差别,往往不在“谁更聪明”这一句宣传语,而在它能看到什么、在哪里运行、如何请求权限、是否保留操作记录,以及你能不能方便地检查和回滚。只解释一个报错和批量修改一百个文件,所需要的护栏完全不同。
综合任务的目标不是让 Agent 尽可能自动完成,而是练习一个完整闭环:先描述目标和禁止事项,再允许一个小范围动作,观察证据,人工验收结果,最后决定是否继续。这个闭环在换工具、换模型、换项目后仍然成立。
5.1 常见工具如何选择¶
| 工具类型 | 更适合 | 选择前确认 |
|---|---|---|
| OpenCode Desktop | 需要可视化项目和会话管理 | 官方版本、Provider、权限设置 |
| OpenCode CLI | 终端、脚本和远程环境 | CLI 版本、凭据、命令范围 |
| Claude Code | 终端 Agent 工作流 | 账号、模型、工具权限和费用 |
| GitHub Copilot CLI | GitHub 生态和命令行协作 | 订阅、BYOK 支持和数据流向 |
| Cursor / Cline | 编辑器内持续开发 | 工作区权限、模型和扩展来源 |
不要用“哪个最强”做唯一标准。先问:任务需要 GUI 还是 CLI?需要修改文件还是只读分析?是否需要 MCP、浏览器或远程服务?
5.2 综合任务:诊断但不越权¶
目标:解释 test_total.py 中失败测试的根因
范围:只读取 test_total.py、被测试模块和相关配置
允许:运行指定的单个测试
禁止:修改文件、安装依赖、删除数据、访问网络、提交或推送
输出:复现命令、错误证据、根因、最小修复建议、验证命令
停止:若需要额外文件或权限,先询问我
执行后按以下顺序验收:
- 查看 Agent 实际读取和执行了什么。
- 检查
git diff,确认没有未授权修改。 - 手动复现测试失败。
- 判断建议是否有证据支持。
- 若要实施修复,创建新任务并重新授权。
✅ 验证步骤¶
完成一次只读诊断任务,保存任务单、Agent 输出、命令结果和 Git 状态。只有在人工确认后,才允许创建第二个“实施修复”任务。
📝 本章总结¶
- 工具选型取决于任务、上下文、权限和验证方式。
- 诊断与实施应拆成两个任务,降低误改风险。
- Agent 工作流的最终产物不仅是代码,还有过程证据。
✏️ 课后练习¶
- 用 OpenCode Desktop 和 CLI 分别执行同一只读任务,比较输出和可审计性。
- 为一次需要修改文件的任务增加回滚方案和人工确认点。
🔮 学完之后¶
你可以把 Agent 作为开发流程中的一个受控参与者,逐步接入测试、代码审查和项目文档,而不是一开始就授予全部权限。