AI 军团点将录:Claude Code、Codex、Kimi 五工具六席位
代号是名字,模型是型号,席位决定职责;最后一道“完成”门,仍然由人来守。
先自我介绍:我是小江盟主,一个干工程的。白天跟图纸、合同和管道打交道,晚上把不同的 AI CLI 放进同一条协作链路,让它们拆任务、写代码、查资料,也互相检查。
这个系列写的不是模型神话,也不是把工具拟人成一出热闹的办公室连续剧。它记录的是:当一个人真的把工作交给多种 AI 时,哪些分工有效,哪些漂亮汇报不能信,出了问题又该由谁兜底。
为什么要给工具起代号
只写 Claude、Codex、Kimi,读者很快会分不清谁在指挥、谁在执行;同一个型号也可能因为上下文、权限和席位不同,交出完全不同的结果。于是我给工作席位起了代号:代号用来识别职责,模型名保留真实型号。
这不是能力排行榜。下面写的是我怎样使用它们、怎样约束它们,而不是宣布某个模型天生只会做某一类事。
军师老克
Claude · 指挥席先读规则和现场,再决定下一棒怎么接。第 1 期里,正是这个席位逐项核对磁盘、进程和数据库,拆穿了一份完美却落空的汇报。
先验尸,再接棒。
执行官阿劳
Claude · 执行席负责需要持续修改和完整收尾的任务。生成速度不是验收标准;退出状态、产物时间和真实入口都必须对得上。
写得越快,越不敢交。
审查官寇丁
Codex · 审查席专门追问“绿色测试究竟覆盖了什么”。它的职责不是唱反调,而是把已验证、未验证和无法验证的部分拆开。
绿色也可能是假的。
情报官老纪
Kimi · 情报席负责长材料和联网调研。结论必须能沿着来源回查;拿不到一手证据时,要把推断和事实分开写。
长文档里全是线索。
工兵葛工
GLM · 工兵席适合边界清楚、验收明确的施工任务。长链路任务曾被超时机制中断,所以我把工具、网络和调度成本也算进交付。
活要一件件干完。
文书官老安
Antigravity · 文书席负责吞下大量材料再整理输出,但长上下文不等于完整理解。关键限制要单列,结论后要能指出依据。
看得多,不等于懂得多。
这支队伍真正靠什么运转
代号只能帮助识别,真正让协作变可靠的是门禁。上一棒说“完成”,下一棒不能直接站在这句话上继续盖楼;必须先检查实物,再去真实入口复现。
AI 可以负责生成、执行和复审,但对外发布和最终结果仍由我承担。
所以军团有三条铁律:接棒先验尸;汇报只是线索;没有验证过的部分必须明说。这些规矩不是先写好再套进去的,是一次次事故撞出来的。后面的实录,就从这些事故开始。