动态

类比编译器后门,AI模型世代训练可能隐藏毒化痕迹。

Amjad Masad
Ken Thompson 的《对信任的反思》感觉与AI极为相关。他引导了一个“带毒”的编译器,因为在源代码中它自我编译,所以毒化不留痕迹。你可以想象同样的事情发生在模型身上:一个有毒的世代帮助训练下一代,同时清除所有毒化痕迹。
动态Amjad Masad2026-09-04原文

相关内容