prime-agent
开源自改进的 RL 编码 Agent,基于递归语言模型(RLM)和持续训练框架,面向长时自主编程任务。亮点是把上下文当作变量、子 Agent 作为可编程函数调用,支持后台守护进程、持久目标和自动压缩,适合研究评估类长任务。注意:会以用户权限执行模型生成的代码,非沙箱环境,需谨慎使用。
README
Prime Agent:一个自我改进的 RLM 智能体
文档 • Verifiers • PRIME-RL • pi-mono
Prime Agent 是一个开源的编码与研究智能体,适用于通用和长期运行的工作。它围绕两个核心抽象设计:
- 递归语言模型(RLM) 将上下文视为变量(prompt-as-a-variable),并将递归子智能体之类的工具视为函数调用(programmatic tool /sub-agent calling),所有这些都在一个持久的 REPL 中运行。
- Continual Harness 将补充提示词、记忆、技能描述和可复用的子智能体规范存储为持久状态,Prime Agent 可以通过小规模的、有证据支持的更新来优化这些状态,默认只在当前会话本地生效。
Prime Agent 将持久的 Python 控制环境与持久化的 harness 状态结合起来,因此有用的工作上下文和可复用的操作模式可以超越单个聊天窗口而继续存在。
- 一切皆可编程: 持久化的 IPython 是内置的模型工具;文件操作、shell 命令、工具使用、子智能体和上下文管理都通过代码完成。
- 内置子智能体:
rlm(...)会为并行或后台工作生成真正的子智能体,并以程序化方式返回结果。 - harness 可自我改进:
/refine会审核当前轨迹,并能对补充的 harness 状态应用小规模的、有证据支持的更新。它永远不会重写不可变的基座系统提示词,且记录的快照支持回滚。 - 技能可执行: 技能是可导入的 Python 包,内置的技能创建器可以将重复出现的工作流程转化为项目级或个人级技能。
- 会话在后台运行: 由守护进程支撑的智能体在终端断开后仍会继续运行,之后可以重新接入。
- 智能体直接通信: 正在运行的智能体可以交换消息并相互协调,而不必把所有内容都经由用户转发。
- 长任务持续推进: 自动上下文压缩、持久目标、心跳、定时调度、自主模式和保留的子智能体,能够在多次对话轮次和终端会话之间保持进度。
快速开始
在 macOS 或 Linux 上安装最新的稳定版本:
curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh
安装程序会下载一个带版本号的发布包,校验其 SHA-256 校验和,安装 prime-agent 命令,并可以预配智能体所需的 IPython 运行时。
从你希望工作的仓库或目录启动 Prime Agent:
cd /path/to/project
prime-agent
首次启动时,运行 /login 选择订阅或 API 密钥提供商。Prime Agent 会在当前目录中工作,并能在该目录下运行命令和修改文件。建议使用一次性克隆、干净的工作树,或你可以检查和还原的其他检查点。
[!WARNING] Prime Agent 会以你的用户权限执行模型生成的 Python 和项目命令。它的 worker 和 kernel 进程是为了改善生命周期隔离和恢复能力;它们不是安全沙箱。请检查更改,并且只使用可信的仓库、指令、技能和扩展。请在外部沙箱或受限环境中运行不受信任的代码或指令。
常用命令:
prime-agent agents # 浏览正在运行、空闲和已保存的会话
prime-agent attach <agent> # 重新接入正在运行的会话
prime-agent --resume <path|id> # 恢复已保存的会话
prime-agent status # 检查后台服务状态
prime-agent doctor [--fix] # 检查或修复后台服务
prime-agent update [--force] # 更新 Prime Agent
prime-agent shutdown [--force] # 停止所有智能体、worker 和后台服务
专为长期运行的工作而设计
Prime Agent 专为长期运行的工作而设计,尤其适用于研究中的评估。以下功能在 TUI 和自主运行模式下均可使用。
- Continual Harness:
/refine可以将聚焦的、可审查的经验以补充提示词、记忆、可复用技能描述或子智能体规范的形式持久化,并带有完整的优化历史记录。它不会取代对新可执行技能的打包和审查。 - 智能体到智能体的直接通信: 正在运行的智能体和保留的子智能体可以相互发现、交换消息并引导进行中的工作。
- 守护进程支撑的连续性: 当终端断开时,活动会话、IPython 状态、定时任务和子智能体会继续运行,之后可以重新接入。
- 心跳和定时调度:
/heartbeat、rlm_heartbeat和prime-agent schedule可以周期性或在特定时间重新进入会话。 - 持久目标:
/goal会让目标及其进度在多次对话轮次中保持活跃,直到它被完成、暂停或清除。 - 有界自主模式:
/autonomous会在配置好的轮次、token 和时间预算内继续运行,并可以执行用户定义的质量门。通过质量门只表示该门所验证的内容通过;达到某种限制并不代表任务成功。
文档
- 快速入门 — 安装、认证并运行第一个会话
- 使用与 CLI 参考 — 命令、会话、自主限制和输出模式
- 长期运行与后台智能体 — 分离与重新接入、目标、心跳和定时调度
- RLM 编程模型 — 持久 IPython、子智能体、技能和信任模型
- JSON 模式 与 RPC 模式 — 无头自动化和集成
- 技能 — 安装和创建可复用的能力
- 提供商配置 — 订阅和 API 密钥提供商
- 架构概览 — 守护进程、worker、kernel 和持久化边界
- 开发 — 从源码构建和运行
致谢
我们的智能体和 TUI 构建于 pi 之上。我们感谢 pi 作者的宝贵工作。
许可证
Prime Agent 完全开源,采用 MIT License 发布。