Awesome World Model Hub 论文 · 数据集 · 项目
← 返回论文列表

幻觉的统一定义,或者:关键在于世界模型,笨蛋

arXiv 25.12 2025 40.1 theory

TLDR

该论文围绕“A Unified Definition of Hallucination, Or: It's the World Model, Stupid”研究世界模型相关问题。

评分理由

Fallback reasoning generated from available title and abstract metadata: Despite numerous attempts at mitigation since the inception of language models, hallucinations remain a persistent problem even in today's frontier LLMs. Why is this? We review existing definitions of hallucination and fold them into a single, unified definition...

Read-first 评分解释

综合优先阅读分 40.1,由主题、引用、图谱、方法、可复现性和近期性等信号加权得到。

近期性 6%
86.7

使用温和的时间衰减,让近期论文更容易浮现,同时保留较早基础工作的价值。 年份:2025

方法质量 18%
80

检查可见的摘要与分析字段,寻找实验、数据集、基线、指标和局限性等方法证据。 命中信号:基准、评估、实验、结果

引用影响力 18%
61.5

使用 OpenAlex 形态的引用元数据作为文献关注度信号,并与论文本身质量分开处理。 归一化引用分位:0.61506576

可复现性 18%
30

检查链接和可见文本中的论文、代码、数据集、工件与仓库信号。 论文:有;代码:无;数据:无;命中信号:无

主题相关性 29%
16.2

将配置的研究关键词与标题、摘要、标签和分析文本进行匹配。 匹配关键词数:3

引用速度 12%
0

引用速度按发表年限估算年均引用,降低旧论文天然占优的偏差。 年均引用:0.00

研究版图角色

前沿论文方法锚点

排序敏感性

稳定性:volatile;排名波动范围:215。

深度分析

创新点

  • 将幻觉统一定义为用户可观察的不准确内部世界建模
  • 通过改变参考世界模型和冲突策略来包含先前定义的框架
  • 区分真正的幻觉与规划或奖励错误
  • 为跨基准比较和缓解策略讨论提供共同语言
  • 与用于压力测试模型幻觉的HalluWorld基准的联系

方法

本文回顾了现有的幻觉定义,并将其综合为基于不准确世界建模的统一定义。它提出了一个通过改变参考世界模型和冲突策略来包含先前定义的框架。该工作还将此框架与HalluWorld基准联系起来,该基准实例化了完全指定的参考世界模型用于压力测试。

关键结果

未呈现实验结果;本文是一项理论/定义性工作,引入了统一定义并将其与HalluWorld基准联系起来。

标签