hallucination·general

hallucination

别名
首次出现
2026-05-22
最近出现
2026-07-28
累计提及
42
§ 01综述

Hallucination是指AI模型生成看似合理但事实上错误或虚构内容的特性,是当前大语言模型面临的核心挑战之一。

Hallucination 近期进展

  • 2026年7月,arXiv上的一篇研究《Hallucination in World Models is Predictable and Preventable》指出,世界模型中的幻觉现象是可预测且可预防的,并提出了一种基于不确定性检测的干预方法。原文标题
  • OpenAI在2025年发布的《Why Language Models Hallucinate》报告中系统分析了幻觉成因,发现训练数据中的长尾分布和模型对事实性奖励的过度优化是主要诱因。原文标题
  • 2025年GPT-4.5研究预览中,OpenAI声称通过扩大模型规模和更好的数据过滤,将幻觉率降低了约40%,但并未完全消除。原文标题
  • 百川AI在2025年多项基准测试中取得SOTA成绩,其模型在事实性问答中表现出较低的幻觉率,但具体方法尚未公开。原文标题
  • 当前焦点与观察点

    当前对hallucination的防御主要分为两类:一类是通过改进训练数据、奖励模型和推理机制来直接减少幻觉发生;另一类是通过检索增强生成(RAG)或事后验证来检测和纠正幻觉。然而,至今没有模型能完全避免hallucination,尤其在开放域生成和长尾知识问题上。业界争议点在于:是否应该追求完全无幻觉的模型,还是在可控范围内接受一定幻觉以换取更高的创造性和灵活性。此外,如何在模型评估中标准化幻觉率也是亟待解决的问题。

    § 02相关报道08 条在档
    1. 01
      Inkling 在 Agent Arena 中排名开放模型第9,总体第30
      lmarena.ai
    2. 02
      GPT-5.6 Sol在Agent Arena排名第二,可操纵性第一
      lmarena.ai
    3. 03
      今年必读的AI术语词汇表
      techcrunch
    4. 04
      Hallucination in World Models is Predictable and Preventable
      arXiv cs.LG
    5. 05
      百川AI模型在多项基准测试中取得SOTA成绩
      百川智能 Baichuan
    6. 06
      OpenAI揭秘语言模型幻觉原因
      OpenAI Blog
    7. 07
      OpenAI GPT-4.5 研究预览发布
      OpenAI Blog
    8. 08
      GPT-5.5 Instant:更智能、清晰、个性化
      OpenAI Blog
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/hallucination