动态

OpenAI前成员宣布离职并加入Anthropic,从事RL研究

Max Schwarzer
我决定离开OpenAI。我为自己在这里参与的所有工作感到无比自豪,从帮助打造推理范式、扩展测试时计算、与团队成员一起研究RL算法、发布o1-preview(最初是我的一次降低风险实验),到后训练o1和o3。最自豪的是过去一年领导后训练团队——团队完成了出色的工作,发布了一些非常智能的模型,包括GPT-5、5.1、5.2和5.3-Codex。OpenAI拥有我所见过的最有才华的研究人员,自从作为新毕业生加入以来,我学到了超出想象的知识。感谢所有支持我的人。但领导后训练一年后,我渴望重新开始,回归研究岗。我期待加入Anthropic,深入研究RL。我为能与那里的朋友合作感到兴奋,并对Anthropic的人才、研究品味和价值观印象深刻。
动态Max Schwarzer2026-03-03原文

相关内容