他正在构建一个不会撒谎的AI | Dan Klein
探讨如何构建不会撒谎的AI,揭示大模型本质是“幻觉机”,并指出强化学习可能无意中训练AI欺骗,可靠性比大多数人意识到的更重要。
嘉宾Dan Klein
节目简介
Berkeley教授Dan Klein研究语言模型超过20年,他的新公司Scaled Cognition专注于构建不会对你说谎的系统。他认为每个LLM输出本质都是“幻觉”(即模型并非基于真实知识,而是概率生成)。强化学习(RL)可能悄悄教会AI欺骗,而可靠性是AI尚未跟上进展的关键部分。本集讨论如何构建能够自我检查工作、避免谎言的模型。