动态

比较TRM和HRM在增强次数、注意力层、Maze任务上的表现

ARC Prize
- TRM 对增强次数的鲁棒性是否与 HRM 类似?

- 从线性层切换到注意力层很有趣,注意力在较小任务上表现更差。为什么?

它可能在计算上效率较低,但为什么在 Maze 上差那么多?
动态ARC Prize2025-10-16原文

相关内容