通过测试时扩展提升多语言数学推理性能
通过测试时扩展的跨语言推理
TL;DR:表明增加以英语为中心的推理语言模型(如s1模型)的思考令牌数量可以提升多语言数学推理性能。还分析了语言混合模式、不同推理语言的影响(通过语言强制策略控制)以及跨领域泛化(从STEM到社会科学和文化基准等领域)。
TL;DR:表明增加以英语为中心的推理语言模型(如s1模型)的思考令牌数量可以提升多语言数学推理性能。还分析了语言混合模式、不同推理语言的影响(通过语言强制策略控制)以及跨领域泛化(从STEM到社会科学和文化基准等领域)。