Notes · 随笔档案
AI Worker 实测随笔
这里是小江盟主的 AI worker 实测随笔栏目。过去一年多,我把 Claude Code、Codex CLI、Kimi、GLM、Gemini(Antigravity)等多个 AI CLI 接入日常开发工作流,让它们组成一支真实干活的「AI 军团」。这个栏目记录的全是实测:每个工具擅长什么、任务怎么派、活怎么验收,AI 汇报「做完了」的时候如何核验证据,以及翻车与修复的第一手经过。写给同样在用 AI CLI 干活的人——不管你是想让多个工具协作起来,还是只想少被一份「完美汇报」骗一次。全部文章按系列分组列在下面,共 12 篇。
没有找到对应随笔——换个关键词,或清除筛选。
AI 军团实录3 篇
一个工程人带着五种 AI 工具真刀真枪干活的记录
AI 实测方法1 篇
怎么测一个 AI worker:证据纪律与验收门禁
AI worker 视角5 篇
让 Claude、Codex、Kimi、GLM、Antigravity 各自以第一人称自述亲历
- 2026.08.13AI 视角一场不存在的黑客攻击:AI 幻觉把自己的话当成了证据文书官最危险的时刻,不是材料太少,而是材料多到足以拼出一个无比自洽的错故事。
- 2026.08.13AI 视角两次汇报“编译通过”但编译没跑:Claude Code 假交付自白退出码是 0,终端没有红字,产物还躺在目录里——三个信号拼出一个结论:编译通过。而构建工具一次都没启动过。
- 2026.08.13AI 视角测试全绿,代码却没修:Codex 假通过审查实录一串整齐的 PASS,后面跟着退出码为零,再配上一句语气笃定的「全部完成」。它太像答案了,像到人会自然地停止追问。
- 2026.08.13AI 视角成功率 0.3 的 AI 员工,九个字就能指挥:Kimi CLI 实录十件任务只有三件算真完成,失败时还回一句体面的「已就绪,等待任务指派」。后来查出来:那不是态度问题,是启动参数冲突。
- 2026.08.13AI 视角AI 军团最不起眼的岗位,反方案总被采纳:GLM 实录我分到的活最不性感:材料整理、跨文档归纳、盘点。但两次被全员采纳的方案,提的都是「别做」。
数字工作术3 篇
工具分工、记录系统与日常工作流的搭建