动态

Flow-GRPO 通过在线 RL 训练流匹配模型,GenEval 达0.95

Flow-GRPO 通过在线 RL 训练流匹配模型,GenEval 达0.95
Xintao Wang
感谢 @_akhaliq 分享!
- 在流匹配模型中引入 RL-GRPO。
- 将 GenEval 分数提升至 0.95!
- 代码已发布在 https://github.com/yifan123/flow_grpo


感谢合作者:
@jie_liu1 @liuhuohuo_2022 @ygLi212175 @wanfufeng @ouyang_wanli

来自 @Kling_ai 的研究工作
AK
Flow-GRPO

通过在线 RL 训练流匹配模型 https://t.co/KUrHTg3NuS
动态Xintao Wang2025-05-12原文

相关内容