行业新闻

AIBuildAI 开源 PostTrain Agent,自动后训练基准登顶

后训练(把基座模型变成会听指令、能推理的模型)向来靠团队几周手工试错,这篇讲 AI 如何自己完成全流程并拿到基准第一,值得关注的是它靠知识库而非模型记忆做决策。

给定基座模型、目标能力和算力预算,AIBuildAI 的 PostTrain Agent 会自己设计后训练方案、整理数据、写代码、跑实验并迭代,全程无需人介入。在自主后训练基准 PostTrainBench 上它拿到 46.6 分,排名第一,超过所有前沿模型与 Agent 系统,接近人类专家的 51.1 分。团队同时开源了代码与配套知识库。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/2714abd2-1c07-4034-88fe-80a32382de8f/036(2).jpg) ![图片](https://mmbiz.qpic.cn/szmmbizpng/5L8bhP5dIqElqZ0GcgINP4V78xIEARSSDI7pRpUQpZAhGK6rr8zoMJM3icYLohdHNhq93gll1YkHwsYaOO3tolCuL5QN5gAtJc46PnNgECQI/640?wxfmt=png&from=appmsgimgIndex=0) 给定一个基座模型、一个目标能力和算力预算,RSI Agent 自己设计后训练算法、收集和整理数据、写代码、跑实验、迭代改进,最终交出一个训练好的模型,全程无人介入。在自主后训练基准 PostTrainBench 上,它以 46.6 分排名第一,超过所有前沿模型与 Agent 系统,接近人类专家表现(51.1)。 近日,AIBuildAI 团队发布了 PostTrain Agent,一个用于自主后训练大语言模型的递归自我改进(RSI)Agent,并开源了全部代码与配套知识库。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-10-02原文

相关内容