(无标题)
In a joint paper with @OwainEvans_UK as part of the Anthropic Fellows Program, we study a surprising phenomenon: subliminal learning.
Language models can transmit their traits to other models, even in what appears to be meaningless data.
https://t.co/oeRbosmsbH