LeCun思考语言模型与视频模型学习差异,发表博客文章 Sergey Levine我一直觉得困惑:语言模型通过下一个词预测学到了这么多,而视频模型通过下一帧预测却学到很少。也许是因为LLM实际上是伪装的大脑扫描仪。我新博客文章中的闲思:https://sergeylevine.substack.com/p/language-models-in-platos-cave… 动态Sergey Levine2025-06-08原文 打开互动版