AI 军团实录 · 第 0 期

AI 军团点将录:Claude Code、Codex、Kimi 五工具六席位

代号是名字,模型是型号,席位决定职责;最后一道“完成”门,仍然由人来守。

2026.08.13系列序篇约 6 分钟阅读

先自我介绍:我是小江盟主,一个干工程的。白天跟图纸、合同和管道打交道,晚上把不同的 AI CLI 放进同一条协作链路,让它们拆任务、写代码、查资料,也互相检查。

这个系列写的不是模型神话,也不是把工具拟人成一出热闹的办公室连续剧。它记录的是:当一个人真的把工作交给多种 AI 时,哪些分工有效,哪些漂亮汇报不能信,出了问题又该由谁兜底。

小江盟主与 AI 军团六个工作席位的分工图
图 1|五种 AI 工具进入六个工作席位,人工验收门始终保留

为什么要给工具起代号

只写 Claude、Codex、Kimi,读者很快会分不清谁在指挥、谁在执行;同一个型号也可能因为上下文、权限和席位不同,交出完全不同的结果。于是我给工作席位起了代号:代号用来识别职责,模型名保留真实型号。

这不是能力排行榜。下面写的是我怎样使用它们、怎样约束它们,而不是宣布某个模型天生只会做某一类事。

军师老克

Claude · 指挥席
拆解 · 派单 · 核验

先读规则和现场,再决定下一棒怎么接。第 1 期里,正是这个席位逐项核对磁盘、进程和数据库,拆穿了一份完美却落空的汇报。

先验尸,再接棒。

执行官阿劳

Claude · 执行席
编码 · 重构 · 交付

负责需要持续修改和完整收尾的任务。生成速度不是验收标准;退出状态、产物时间和真实入口都必须对得上。

写得越快,越不敢交。

审查官寇丁

Codex · 审查席
反证 · 测试 · 边界

专门追问“绿色测试究竟覆盖了什么”。它的职责不是唱反调,而是把已验证、未验证和无法验证的部分拆开。

绿色也可能是假的。

情报官老纪

Kimi · 情报席
检索 · 长文档 · 来源

负责长材料和联网调研。结论必须能沿着来源回查;拿不到一手证据时,要把推断和事实分开写。

长文档里全是线索。

工兵葛工

GLM · 工兵席
数据 · SQL · 小功能

适合边界清楚、验收明确的施工任务。长链路任务曾被超时机制中断,所以我把工具、网络和调度成本也算进交付。

活要一件件干完。

文书官老安

Antigravity · 文书席
档案 · 翻译 · 依据

负责吞下大量材料再整理输出,但长上下文不等于完整理解。关键限制要单列,结论后要能指出依据。

看得多,不等于懂得多。

这支队伍真正靠什么运转

代号只能帮助识别,真正让协作变可靠的是门禁。上一棒说“完成”,下一棒不能直接站在这句话上继续盖楼;必须先检查实物,再去真实入口复现。

AI 工作从完成汇报经过磁盘、进程和数据三道证据门的流程图
图 2|汇报进入证据链,全部通过后才进入人工验收
AI 可以负责生成、执行和复审,但对外发布和最终结果仍由我承担。

所以军团有三条铁律:接棒先验尸;汇报只是线索;没有验证过的部分必须明说。这些规矩不是先写好再套进去的,是一次次事故撞出来的。后面的实录,就从这些事故开始。

编者说明:本文由 AI 军团协作整理、小江盟主审校定稿。成员代号是工作席位的叙事化名称,模型名称是真实工具类别;具体职责描述来自当前协作方式,不构成通用模型能力排名。
小江盟主赛博工具补给站主理人 · CyberSynth 作者
AI 军团实录 / 000