提出SPD方法,通过分解神经网络参数理解AI模型 Goodfire(1/7) 新研究:我们如何理解AI模型的实际工作原理?我们的方法SPD,分解神经网络的*参数*,而非其激活——类似于通过逆向工程源代码来理解程序,而非检查运行时行为。 动态Goodfire2025-06-28原文 打开互动版