Forge:一句话派活,几个 AI 同时写代码Forge: an assembly line for coding agents
- 年份
- 2026
- 状态
- 停了
- 结果
- 一句话派活,34 个 PR 里 30 个合进了主干,每个都过了两个模型的审查
Forge 是一条流水线:在 Discord 里发一句「做这个功能」,它把活拆开,起几个 Claude Code 并行写,写完自动构建、开 PR、再让两个模型各审一遍,跑到哪一步、哪里报错,都回到同一个频道。整套东西是七个 bash 脚本,八百多行,没有一行业务代码。
它的设计前提是不指望 agent 自觉。接消息的那个 agent 只拆任务、起进程,不写代码;写代码的 agent 只干第一步,写完提交。之后的构建、类型检查、推分支、开 PR,都由外面的脚本按顺序跑,agent 没有跳过的机会。审查是把同一份改动分别交给 Claude 和 Codex,只有会崩、会丢数据、有安全漏洞这三类能拦下合并,最多打回两轮;其余建议只记下来,不挡路。
最意外的是 agent 真的不听话。文档里写得明明白白,起任务必须走某个脚本,它照样自己开个工作目录就干起来,在提示词里反复叮嘱也没用。于是又写了个巡查脚本挂在定时任务里,专门抓这种绕开流程的现场:把它自己搭的那套换成标准流程;如果代码已经在写了,就等它提交完,从构建那一步接管;十五分钟一次提交都没有,就当它卡住了,杀掉重来。
它真跑起来过。2 月 28 号到 3 月 3 号,它在 DODGE AGENT(也在这个站上)的仓库里推出 34 个 PR,30 个合进了主干。每个 PR 底下都挂着两条机器写的审查意见,抓到的问题不是凑数:定时任务那个接口,密钥没配的时候鉴权能被绕过;一条数据库查询忘了按公司隔离,一家的操作能碰到另一家的数据;新加的迁移文件跟已有的撞了号。审查记录会存档,下次拆任务之前先读一遍。
停下来不是因为不好使,是因为太重:一个常驻的 Discord 机器人、一个终端管理器、两条定时任务,全绑在我这一台机器上,内存只够同时跑四个 agent;仓库只有 2 月 28 号那两次提交。3 月 8 号我开了 claudeorc,同一套流程,不依赖 Discord,也不绑在某一台机器上,那个仓库是公开的。留下的是这句:只要一件事得指望 agent 自觉遵守,它就不算规则;要么写在它跳不过去的地方,要么就当它一定会跳过去。