ICML 2026:研究者提出大模型幻觉统一定义框架
统一“幻觉”定义:将其形式化为相对于参考世界模型的可观察错误,并给出评测要素,使各任务可比较。
大模型“幻觉”研究长期缺乏统一定义:同一回答在摘要任务中算幻觉,在开放域问答中却不算。来自 CMU、斯坦福等机构的研究者提出,幻觉的本质是模型对“参考世界模型”(指定用于判断真假的参照结构)的错误建模,并引入视图、冲突策略、真值函数三个显式化要素,让不同任务可比较、可复现。
正文摘录
.jpg)  同一个回答,在摘要任务里算幻觉,在开放域问答里却不一定是 —— 大模型 “幻觉” 研究的分裂,到了连 “什么是幻觉” 都无法达成共识的地步。在第一篇 ICML 2026 Position Paper 中,研究者们给出了一个直截了当的回答:笨蛋,幻觉的问题在于大模型内部的 “世界模型” 认知(It‘s The World Model, Stupid!)  - ICML2026 Position Paper:We Need A Unified Definition of Hallucination (It’s The World Model, Stupid!) - 论文链接:https://arxiv.org/abs/2512.21577 - Follow-up …