Hallucination in Language Models

Latest papers 187

All topics
CardsList
  1. Med-StepBench: A Hierarchical Reasoning Framework for Evaluating Hallucinations in Medical Vision-Language Models

    May 11, 2026Minh Khoi Nguyen, Dai Lam Le, Amir Reza Jafari +8HealthcareHallucination Detection

  2. Source or It Didn't Happen: A Multi-Agent Framework for Citation Hallucination Detection

    May 9, 2026Mingzhe Li, Zhiqiang Lin, Shiqing MaHallucination in Language ModelsCitation Verification

  3. Sanity Checks for Long-Form Hallucination Detection

    May 8, 2026Geigh Zollicoffer, Minh Vu, Hongli Zhan +2LLM EvaluationHallucination Detection

  4. Hallucination Detection via Activations of Open-Weight Proxy Analyzers

    May 8, 2026Akshita Singh, Prabesh Paudel, Siddhartha RoyHallucination in Language ModelsLLM Reliability

  5. Hallucination as an Anomaly: Dynamic Intervention via Probabilistic Circuits

    May 7, 2026Erik Nielsen, Elia Cunegatti, Marcus Vukojevic +1Probabilistic CircuitsLLM Hallucination Mitigation

  6. Attractor Geometry of Transformer Memory: From Conflict Arbitration to Confident Hallucination

    May 7, 2026Qiyao Liang, Risto Miikkulainen, Ila FieteMemorization in Language ModelsKnowledge Conflicts in Language Models

  7. The First Token Knows: Single-Decode Confidence for Hallucination Detection

    May 6, 2026Mina GabrielUncertainty QuantificationSelf-Consistency Decoding

  8. CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering

    May 6, 2026Qiming Li, Zekai Ye, Xiaocheng Feng +9Hallucination in Language ModelsLarge Vision-Language Models

  9. MedFabric and EtHER: A Data-Centric Framework for Word-Level Fabrication Generation and Detection in Medical LLMs

    May 5, 2026Tung Sum Thomas Kwok, Qian Qian, Xiaofeng Lin +8HealthcareHallucination Detection

  10. Not All That Is Fluent Is Factual: Investigating Hallucinations of Large Language Models in Academic Writing

    May 5, 2026Humam Khan, Md Tabrez Nafis, Shahab Saquib Sohail +2LLM EvaluationLLM Prompting

  11. Logical Consistency as a Bridge: Improving LLM Hallucination Detection via Label Constraint Modeling between Responses and Self-Judgments

    May 5, 2026Hao Mi, Qiang Sheng, Shaofei Wang +7Hallucination in Language ModelsLLM Hallucination Detection

  12. A multilingual hallucination benchmark: MultiWikiQHalluA

    May 4, 2026Freja Thoresen, Dan Saattrup SmartMultilingual Language ModelsMultilingual Language Model Evaluation

  13. Only Say What You Know: Calibration-Aware Generation for Long-Form Factuality

    May 3, 2026Wen Luo, Guangyue Peng, Liang Wang +7Long-Form Document GenerationLLM Hallucination Mitigation

  14. Hallucinations Undermine Trust; Metacognition is a Way Forward

    May 2, 2026Gal Yona, Mor Geva, Yossi MatiasLLM Hallucination MitigationHallucination in Language Models

  15. LLM Ghostbusters: Surgical Package Hallucination Suppression via Adaptive Unlearning

    May 1, 2026Joseph Spracklen, Pedram Aghazadeh, Farinaz Koushanfar +1LLM Hallucination MitigationHallucination in Language Models

  16. ReLay: Personalized LLM-Generated Plain-Language Summaries for Better Understanding, but at What Cost?

    May 1, 2026Joey Chan, Yikun Han, Jingyuan Chen +8LLM PersonalizationLanguage Model Safety Evaluation

  17. From Flat Facts to Sharp Hallucinations: Detecting Stubborn Errors via Gradient Sensitivity

    May 1, 2026Yee Zhing Liew, Andrew Huey Ping Tan, Anwar P. P. Abdul MajeedHallucination DetectionHallucination in Language Models

  18. Online Self-Calibration Against Hallucination in Vision-Language Models

    May 1, 2026Minghui Chen, Chenxu Yang, Hengjie Zhu +3Vision-Language ModelsHallucination in Language Models

  19. Geometry-Calibrated Conformal Abstention for Language Models

    Apr 30, 2026Rui Xu, Yi Chen, Sihong Xie +1Uncertainty QuantificationSelective Prediction

  20. MoRFI: Monotonic Sparse Autoencoder Feature Identification

    Apr 29, 2026Dimitris Dimakopoulos, Shay B. Cohen, Ioannis KonstasLLM Hallucination MitigationLLM Interpretability

  21. From Architecture to Output: Structural Origins of Hallucination in Large Language Models and the Amplifying Role of Data

    Apr 29, 2026Md. Rejaul Korim Sadi, Toufiqur Rahman Tasin, Golam Mostofa NaeemHallucination in Language ModelsLLM Reliability

  22. HIVE: Hidden-Evidence Verification for Hallucination Detection in Diffusion Large Language Models

    Apr 28, 2026Guoshenghui Zhao, Tan Yu, Weijie ZhaoHallucination DetectionHallucination in Language Models

  23. Prefill-Time Intervention for Mitigating Hallucination in Large Vision-Language Models

    Apr 28, 2026Chengsheng Zhang, Chenghao Sun, Xinyan Jiang +2Vision-Language ModelsHallucination in Language Models

  24. Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation

    Apr 27, 2026Yubo Jiang, Xin Yang, Abudukelimu Wuerkaixi +7Hallucination in Language ModelsObject Hallucination in VLMs