跳转至

第 5 章:工具选型与综合任务 — 选择合适的工作台

📋 本章概览

项目 内容
学习时长 10 分钟
核心概念 GUI、CLI、IDE、Agent、MCP、验收
核心比喻 不同 Agent 是不同工作台,关键是任务和边界匹配
实践任务 完成一次受控的代码问题诊断
难度等级 ★★★☆☆

选工具先看任务,不先看排行榜

不同 Agent 工具的差别,往往不在“谁更聪明”这一句宣传语,而在它能看到什么、在哪里运行、如何请求权限、是否保留操作记录,以及你能不能方便地检查和回滚。只解释一个报错和批量修改一百个文件,所需要的护栏完全不同。

综合任务的目标不是让 Agent 尽可能自动完成,而是练习一个完整闭环:先描述目标和禁止事项,再允许一个小范围动作,观察证据,人工验收结果,最后决定是否继续。这个闭环在换工具、换模型、换项目后仍然成立。

5.1 常见工具如何选择

工具类型 更适合 选择前确认
OpenCode Desktop 需要可视化项目和会话管理 官方版本、Provider、权限设置
OpenCode CLI 终端、脚本和远程环境 CLI 版本、凭据、命令范围
Claude Code 终端 Agent 工作流 账号、模型、工具权限和费用
GitHub Copilot CLI GitHub 生态和命令行协作 订阅、BYOK 支持和数据流向
Cursor / Cline 编辑器内持续开发 工作区权限、模型和扩展来源

不要用“哪个最强”做唯一标准。先问:任务需要 GUI 还是 CLI?需要修改文件还是只读分析?是否需要 MCP、浏览器或远程服务?

5.2 综合任务:诊断但不越权

目标:解释 test_total.py 中失败测试的根因
范围:只读取 test_total.py、被测试模块和相关配置
允许:运行指定的单个测试
禁止:修改文件、安装依赖、删除数据、访问网络、提交或推送
输出:复现命令、错误证据、根因、最小修复建议、验证命令
停止:若需要额外文件或权限,先询问我

执行后按以下顺序验收:

  1. 查看 Agent 实际读取和执行了什么。
  2. 检查 git diff,确认没有未授权修改。
  3. 手动复现测试失败。
  4. 判断建议是否有证据支持。
  5. 若要实施修复,创建新任务并重新授权。

✅ 验证步骤

完成一次只读诊断任务,保存任务单、Agent 输出、命令结果和 Git 状态。只有在人工确认后,才允许创建第二个“实施修复”任务。

📝 本章总结

  • 工具选型取决于任务、上下文、权限和验证方式。
  • 诊断与实施应拆成两个任务,降低误改风险。
  • Agent 工作流的最终产物不仅是代码,还有过程证据。

✏️ 课后练习

  1. 用 OpenCode Desktop 和 CLI 分别执行同一只读任务,比较输出和可审计性。
  2. 为一次需要修改文件的任务增加回滚方案和人工确认点。

🔮 学完之后

你可以把 Agent 作为开发流程中的一个受控参与者,逐步接入测试、代码审查和项目文档,而不是一开始就授予全部权限。