推理VLM实现内在自纠正,仅用20k数据提升性能 DailyPapers推理视觉语言模型获得了Sherlock新框架实现内在自纠正,仅用2万随机采样数据即可提升性能! 动态DailyPapers2025-05-29原文 打开互动版