Ludo Atlas · AI 工作流 · AI 智能体¶
本页是《AI 工作流手册》的专题分册:把「让代理帮你干活」从单次问答推进到可编排、可审查、可回滚的完整形态。 时点 2026 年 10 月,与主册一致:方法优先,工具名与版本以官网为准(入口见《资源大全》§2.9)。 一条边界先写清楚:智能体能自己动手,但责任不跟着转移。它的每一步都得落在你能审查、能回滚的地方。
1. 智能体和「聊天问答」差在哪¶
| 能力 | 聊天问答 | 智能体 |
|---|---|---|
| 读代码库 | 你贴给它 | 自己读、自己搜 |
| 执行命令 | 做不了 | 自己跑命令、跑测试 |
| 任务跨度 | 一次一问 | 长任务自主推进 |
| 产出形态 | 文本 | 落地改动:文件、diff、提交 |
差别集中在一句话:它能自己动手改东西。好处是省来回,新问题是「越权」和「跑偏」,本页一半篇幅都在讲怎么控制这两件事。
2. 形态与代表(2026 年 10 月)¶
| 形态 | 代表 | 介入方式 | 适合 |
|---|---|---|---|
| 终端代理 | Claude Code、Codex CLI、Gemini CLI、opencode、aider | 在仓库里跑,直接读写文件与命令 | 大改动、跨文件任务、脚本化批次 |
| 编辑器代理 | Cursor、Copilot、Cline、Continue、Windsurf | IDE 内联补全与对话 | 边写边改、局部任务 |
| 云端代理 | 各平台的工单式编码代理 | 派任务排队执行、产出 PR | 并行小任务、不占本地资源 |
| 流水线机器人 | CI 里的代理脚本(配合 GitHub Actions 等) | 在 CI 中执行固定任务 | 例行维护、测试修复、文档同步 |
选型沿用主册结论:一套主力跑顺,收益大于换来换去。关键不是形态,是流程。
3. 一个长任务长什么样(计划、执行、验证)¶
- 写验收:先写下预期行为,或一条能跑的测试。
- 先看计划:让它出步骤清单,你花一分钟过目。跑三小时才发现方向错了,是常见事故。
- 限范围:一次一个功能点;写明允许改哪些目录,其他一律不碰。
- 设检查点:每过一个节点提交一次。智能体会犯错,检查点决定纠错成本。
- 人读 diff:不看 diff 不算完成。
- 收尾:把新约定写回 AGENTS.md,清掉临时脚本。
四条硬规则:一次一事;动手前先有干净提交;失败就回滚到上一个检查点;测试全绿才算过。
4. 多代理与编排:什么时候值得¶
- 可并行的活:互不依赖的模块、批量迁移、多语言翻译、按目录拆分的重构。
- 常见套路:一个牵头的智能体写任务清单,多个执行智能体各领一块,最后按清单验收。
- 值得的条件:任务可分解、接口清楚、你负担得起审查。审查成本通常是大头。
- 不值得的活:耦合改动、模糊需求、顺手就能做完的小事。
- 冲突处理:多个智能体改同一仓库时,先分配好文件归属;合并冲突交给人工判断,别让它们互相打补丁。
- 务实提醒:多数独立开发场景,串行小步加频繁提交就够了。编排是工具,不是军备竞赛。
5. 上下文工程进阶(主册 §2.2 的展开)¶
- 常驻文件分层:AGENTS.md(命令、规范、禁区)放第一位;SPEC、ARCHITECTURE、决策记录按需补;踩坑记录持续追加。
- 写清「不用什么」:不引入新依赖、不启用某模式。预防跑偏比事后纠正便宜。
- 记忆落在仓库里:长期有效的事实写进文件,别指望会话记忆;换工具也能带走。
- 重复流程技能化:同一套步骤讲第三遍时,写成 Skill,方法见《游戏开发需要的 Skill》。
- 反例:把整个知识库塞进上下文;写一份从不更新的大型规范。
6. 权限与安全¶
- 最小权限:只读起步,写权限按目录放,命令白名单逐项开。
- 凭据管理:令牌放环境变量或本机凭据,不进仓库、不进提示词。
- 永远人工确认的动作:删除文件、强推分支、发布上线、付款、修改 CI 密钥。
- 审计:要求提交信息写清改了什么、为什么;出问题能回放。
- 沙箱:能跑在容器或虚拟机里,就别让它直接握宿主机。
7. 成本账¶
用不用智能体做一件事,算三个数:
- token 或订阅的直接花费;
- 你的审查时间(读完、验证、返工);
- 事故成本(出错概率乘上出错代价)。
划算信号:验证快、重复度高、不碰核心手感。不划算信号:需求模糊、审美决策、你比它更懂细节的微调。简单标准:省下的时间减掉审查和返工,还有盈余就用,没有就自己做。
8. 游戏项目里的任务清单¶
| 任务 | 推荐形态 | 检查点 |
|---|---|---|
| 样板代码与工具脚本 | 终端代理 | 跑一遍 + 人工读 diff |
| 数据表与配置批量转换 | 终端代理(脚本化) | 转换前后行数与抽样一致 |
| 场景批量搭建与属性修改 | 引擎 MCP(主册 §3) | 截图比对 + 分支提交 |
| 冒烟测试机器人 | 无头运行 + CI | 日志断言全过 |
| 本地化批次 | 终端代理 + 术语表 | 每语言抽样精读 |
| 崩溃日志聚类 | 终端代理 | 归组结果人工复核 |
| 文档与更新日志草稿 | 编辑器代理 | 对外文字人工定稿 |
| 商店素材整理与命名 | 编辑器代理 | 人工终审尺寸与规范 |
9. 智能体特有的坑¶
- 长任务跑偏不回头。设检查点,错了就退,不要让它一边跑一边补。
- 越修越多。范围没限死,它会顺手重构一切。
- 报告与实际不符。总结说得漂亮,diff 里却全是别的东西:只看 diff。
- 上下文腐化。同一会话改了又改、要求反复叠加时,开新任务比接着聊干净。
- 权限过大的事故。删除、强推、发布这类关口,必须人工确认。
- 把编排当成绩。并行开了十个,审查不过来,等于十个都没做。
- 幻觉 API。贴官方文档给它,或要求先查版本对应的文档再动手。
10. 一天上手路径¶
- 选一个主力代理,装好、登录,在测试仓库跑通一次。
- 写十行以内的 AGENTS.md:构建命令、测试命令、禁区。
- 挑一件低风险重复活(批量改名、脚本生成),按 §3 流程跑一遍。
- 把这次的检查点清单写下来,下一个任务直接用。
- 把一个重复流程沉淀成 Skill,进入下一专题。
配套阅读:主册《AI 工作流手册》(判断表、工作循环、红线);专题《游戏开发需要的 Skill》(技能包清单与配置);《资源大全》§2.9(工具与生态入口);《AI 工作流手册》§3(引擎 MCP)。