比较TRM和HRM在增强次数、注意力层、Maze任务上的表现 ARC Prize- TRM 对增强次数的鲁棒性是否与 HRM 类似? - 从线性层切换到注意力层很有趣,注意力在较小任务上表现更差。为什么?它可能在计算上效率较低,但为什么在 Maze 上差那么多? 动态ARC Prize2025-10-16原文 打开互动版