SpaceXAI 工程师五个月合入 3000 个 PR,靠多智能体自治与硬性护栏
这位工程师展示了如何用验证和工程护栏,而非单纯依赖模型能力,让大量 AI 智能体安全地并行交付代码。
SpaceXAI 工程师 Lauren Tan 同时跑 20 多个智能体,上个月交付 1000 多个 PR。她靠的不是强模型,而是给智能体造“眼睛”——能自己跑应用、截图、读控制台,并用 feature map 标注功能入口。她还用自动化智能体 Benny 值夜班复现 bug,并在架构上禁用 useEffect 和注释,把护栏做硬。
正文摘录
新智元报道  同时跑 20 多个智能体,上个月交付 1000 多个 PR,8 月的目标是翻倍。 这位 GrokBot 工程师拉出 GitHub 贡献曲线:五个月,3000 多个 PR。  提 PR、跑验证、合进主干,整个链条智能体自己跑完,中间不用她过手。 用她的话说:一觉醒来,20 个 PR 已经躺在主干分支上了。而且翻了一遍,写得还不错。 她也知道,这话听着有点让人怀疑这些代码的质量,紧跟着补了一句: 这么说显得我像个批量制造垃圾代码的人,我保证我不是。 她的做法,是同时跑 20 多个 GrokBot,装在她自己开源的 pstack 里,配合 /loop、/goal 和 /swarm,让智能体完整地拥有一个任务,自己干,自己验,自己交。 这位工程师叫 Lauren Tan。 她是前 Cursor 工程师,此前待过 Meta 和 Netflix,在 Netflix 当过两年工程经理,现在负责 SpaceXAI 的 GrokBot。  Lauren Tan 在 GrokBot 团队工作坊上分享。 AI 写代码已经不稀奇。 真正让人好奇的,一个人一个月提交 1000 多个 PR,马上就要直奔 2000 个,而且没把代码库变成一堆垃圾。 她是怎么做到的?