动态

HuggingFace的ml-intern开源agent自动完成ML后训练循环

Anand Butani
HuggingFace的ml-intern 太疯狂了。你只需输入一个高层次的提示(如“构建最佳科学推理模型”或“碾压医疗基准”),这个开源agent就会完成整个后训练循环:
• 研究arXiv论文+引用图
• 从HF Hub拉取并清理数据集
• 实现SFT、GRPO、合成数据等
• 启动训练任务(本地或HF)
• 监控运行、读取评估、诊断失败、运行消融并迭代
基本上就是一个全职且永不睡眠的ML研究员,始终基于实时文档。太不可思议了。

#AIResearch #AI #ML
Aksel
介绍ml-intern,这个agent刚刚实现了HuggingFace后训练团队的自动化。它是我们ML研究员每天实际研究循环的开源实现。你给它一个提示,它研究论文,查看引用,在GPU上实现想法。
动态Anand Butani2026-04-22原文

相关内容