Qwen发布安全对齐模型Qwen3-4B-SafeRL DailyPapersQwen 刚刚在 Hugging Face 上发布了 Qwen3-4B-SafeRL,一个安全对齐模型,使用强化学习以抵抗有害提示而不牺牲有用性。 动态DailyPapers2025-09-30原文 打开互动版