动态

AI长任务需分阶段并加验证,否则易跑偏

宝玉
让 AI 干很长时间的活,核心是规划和验证:
1. 如原推那样规划成小的阶段
2. 另外每个阶段最好有明确的验证方法,这一步很重要,可以是自动化测试(单元测试、集成测试、端到端测试)

所以长任务最适合的场景是那种测试覆盖完整的语言迁移,比如 bun 从 zig 迁移到 rust,一百万行代码的变更,但是测试覆盖完整,而且 AI 主要做的是“翻译”的工作,还可以验证,那连着跑几个几周都没问题,还不担心跑偏。

普通任务,如果没有办法让 Agent 自己验证,还跑很久,就很容易出现南辕北辙的情况,跑的时间越长,偏的越远。还是自己中间验证一下更好。
老C@codedump.info
我看了很多人描述他们如何使用AI编程,看到里面很多有类似“让AI干了一晚上”这样的表述,所以这是现在使用AI编程的常规操作?按照这样干很长时间产生很多代码的做法,碳基人想review都难。

我大致说一下我怎么AI编程的。最开始我先了解需求,划分阶段,生成一个类似 phase.md
动态宝玉2026-05-16原文

相关内容