热门产品

Stagent

Stagent

Stagent通过定义状态机驱动Claude Code完成长任务,防止中途放弃,适合需要自动化多步骤工作流的开发者。

Maker 说

嘿 PH —— 我是 Jie,stagent 的开发者。

我花了几个月时间试图让 Claude Code 执行长任务。问题不在模型本身,而在于循环。一次长会话能让智能体自己给自己打分。

你跟它说“先看看代码库”——它老实三回合,然后就开始凭记忆写代码了。
你跟它说“找到根本原因”——它给你写个 try/except: pass。
你跟它说“TDD”——它写完实现,把测试留成 TODO。
你跟它说“审计整个 repo”——它随便扫几个文件,列一堆“竞态条件!空值检查!”,改两个文件,然后停了。

所以我做了 stagent。它能运行任何你能描述成状态机的工作流——你的阶段、你的转换、你的关卡。不同阶段用不同的智能体——它不能自己批准自己,也不能半路撂挑子。

用自然语言描述你想要什么,然后 /stagent:create 就能帮你搭出整个工作流。或者浏览 cookbook 找灵感——里面有 14 个我们自己反复遇到的长任务模式:https://stagent.worldstatelabs.c...

另外:支持实时浏览器查看、跨机器恢复。

Claude Code 老帮你半途而废的长任务是什么?

热门评论

PH 用户
Claude Code 在处理长任务时的一个致命问题是无声的上下文漂移——明明我们已经约定好的东西,20 条消息之后就开始慢慢消失,但它的信心却一直很高。stagent 能检测到这个吗?还是依赖显式的 checkpointing?好奇你们有没有找到某个信号,能在模型还以为自己一切正常之前就触发警告。恭喜上线,祝好运 :)
PH 用户
我喜欢把不同职责拆给多个智能体,而不是让一个智能体搞定整个流程的思路。不过我有点好奇——如果这些智能体共享相似的上下文和推理模式,怎么防止它们在各个阶段表现得像同一个智能体?
热门产品Jie2026-05-14原文

相关内容