作者介绍基于微调和RL训练的国际象棋引擎 Amjad Masad如果你想试试我的国际象棋引擎(开发中):https://t.co/4WJ9SYmr1o它在国际象棋上似乎已经表现优于前沿模型。它基于200万条Stockfish标记的位置进行微调,然后进行简短的GRPO RL训练。附带了包含所有实验和注释代码的文档/教程。 动态Amjad Masad2026-07-17原文 打开互动版