动态

通过强化学习让模型自主管理上下文,实现长期任务代理

通过强化学习让模型自主管理上下文,实现长期任务代理
Andrew Curran
来自博文:
“我们相信,通过强化学习让模型端到端地管理自己的上下文将是下一个重大突破,使得智能体能够解决跨越数周至数月的长周期任务。”
Prime Intellect
我们相信长周期智能体的下一个突破是训练模型管理自己的上下文。

介绍我们关于递归语言模型的新研究方向。

我们分享了初步实验,展示了RLM的前景。

https://t.co/NwgFbn6kwa
动态Andrew Curran2026-01-01原文

相关内容