跳转至

Ludo Atlas · AI 工作流 · AI 智能体

本页是《AI 工作流手册》的专题分册:把「让代理帮你干活」从单次问答推进到可编排、可审查、可回滚的完整形态。 时点 2026 年 10 月,与主册一致:方法优先,工具名与版本以官网为准(入口见《资源大全》§2.9)。 一条边界先写清楚:智能体能自己动手,但责任不跟着转移。它的每一步都得落在你能审查、能回滚的地方。


1. 智能体和「聊天问答」差在哪

能力 聊天问答 智能体
读代码库 你贴给它 自己读、自己搜
执行命令 做不了 自己跑命令、跑测试
任务跨度 一次一问 长任务自主推进
产出形态 文本 落地改动:文件、diff、提交

差别集中在一句话:它能自己动手改东西。好处是省来回,新问题是「越权」和「跑偏」,本页一半篇幅都在讲怎么控制这两件事。

2. 形态与代表(2026 年 10 月)

形态 代表 介入方式 适合
终端代理 Claude Code、Codex CLI、Gemini CLI、opencode、aider 在仓库里跑,直接读写文件与命令 大改动、跨文件任务、脚本化批次
编辑器代理 Cursor、Copilot、Cline、Continue、Windsurf IDE 内联补全与对话 边写边改、局部任务
云端代理 各平台的工单式编码代理 派任务排队执行、产出 PR 并行小任务、不占本地资源
流水线机器人 CI 里的代理脚本(配合 GitHub Actions 等) 在 CI 中执行固定任务 例行维护、测试修复、文档同步

选型沿用主册结论:一套主力跑顺,收益大于换来换去。关键不是形态,是流程。

3. 一个长任务长什么样(计划、执行、验证)

  1. 写验收:先写下预期行为,或一条能跑的测试。
  2. 先看计划:让它出步骤清单,你花一分钟过目。跑三小时才发现方向错了,是常见事故。
  3. 限范围:一次一个功能点;写明允许改哪些目录,其他一律不碰。
  4. 设检查点:每过一个节点提交一次。智能体会犯错,检查点决定纠错成本。
  5. 人读 diff:不看 diff 不算完成。
  6. 收尾:把新约定写回 AGENTS.md,清掉临时脚本。

四条硬规则:一次一事;动手前先有干净提交;失败就回滚到上一个检查点;测试全绿才算过。

4. 多代理与编排:什么时候值得

  • 可并行的活:互不依赖的模块、批量迁移、多语言翻译、按目录拆分的重构。
  • 常见套路:一个牵头的智能体写任务清单,多个执行智能体各领一块,最后按清单验收。
  • 值得的条件:任务可分解、接口清楚、你负担得起审查。审查成本通常是大头。
  • 不值得的活:耦合改动、模糊需求、顺手就能做完的小事。
  • 冲突处理:多个智能体改同一仓库时,先分配好文件归属;合并冲突交给人工判断,别让它们互相打补丁。
  • 务实提醒:多数独立开发场景,串行小步加频繁提交就够了。编排是工具,不是军备竞赛。

5. 上下文工程进阶(主册 §2.2 的展开)

  • 常驻文件分层:AGENTS.md(命令、规范、禁区)放第一位;SPEC、ARCHITECTURE、决策记录按需补;踩坑记录持续追加。
  • 写清「不用什么」:不引入新依赖、不启用某模式。预防跑偏比事后纠正便宜。
  • 记忆落在仓库里:长期有效的事实写进文件,别指望会话记忆;换工具也能带走。
  • 重复流程技能化:同一套步骤讲第三遍时,写成 Skill,方法见《游戏开发需要的 Skill》。
  • 反例:把整个知识库塞进上下文;写一份从不更新的大型规范。

6. 权限与安全

  • 最小权限:只读起步,写权限按目录放,命令白名单逐项开。
  • 凭据管理:令牌放环境变量或本机凭据,不进仓库、不进提示词。
  • 永远人工确认的动作:删除文件、强推分支、发布上线、付款、修改 CI 密钥。
  • 审计:要求提交信息写清改了什么、为什么;出问题能回放。
  • 沙箱:能跑在容器或虚拟机里,就别让它直接握宿主机。

7. 成本账

用不用智能体做一件事,算三个数:

  • token 或订阅的直接花费;
  • 你的审查时间(读完、验证、返工);
  • 事故成本(出错概率乘上出错代价)。

划算信号:验证快、重复度高、不碰核心手感。不划算信号:需求模糊、审美决策、你比它更懂细节的微调。简单标准:省下的时间减掉审查和返工,还有盈余就用,没有就自己做。

8. 游戏项目里的任务清单

任务 推荐形态 检查点
样板代码与工具脚本 终端代理 跑一遍 + 人工读 diff
数据表与配置批量转换 终端代理(脚本化) 转换前后行数与抽样一致
场景批量搭建与属性修改 引擎 MCP(主册 §3) 截图比对 + 分支提交
冒烟测试机器人 无头运行 + CI 日志断言全过
本地化批次 终端代理 + 术语表 每语言抽样精读
崩溃日志聚类 终端代理 归组结果人工复核
文档与更新日志草稿 编辑器代理 对外文字人工定稿
商店素材整理与命名 编辑器代理 人工终审尺寸与规范

9. 智能体特有的坑

  1. 长任务跑偏不回头。设检查点,错了就退,不要让它一边跑一边补。
  2. 越修越多。范围没限死,它会顺手重构一切。
  3. 报告与实际不符。总结说得漂亮,diff 里却全是别的东西:只看 diff。
  4. 上下文腐化。同一会话改了又改、要求反复叠加时,开新任务比接着聊干净。
  5. 权限过大的事故。删除、强推、发布这类关口,必须人工确认。
  6. 把编排当成绩。并行开了十个,审查不过来,等于十个都没做。
  7. 幻觉 API。贴官方文档给它,或要求先查版本对应的文档再动手。

10. 一天上手路径

  1. 选一个主力代理,装好、登录,在测试仓库跑通一次。
  2. 写十行以内的 AGENTS.md:构建命令、测试命令、禁区。
  3. 挑一件低风险重复活(批量改名、脚本生成),按 §3 流程跑一遍。
  4. 把这次的检查点清单写下来,下一个任务直接用。
  5. 把一个重复流程沉淀成 Skill,进入下一专题。

配套阅读:主册《AI 工作流手册》(判断表、工作循环、红线);专题《游戏开发需要的 Skill》(技能包清单与配置);《资源大全》§2.9(工具与生态入口);《AI 工作流手册》§3(引擎 MCP)。