LLM Hallucination Detection

LLM: Large Language Model

Latest papers 141

All topics
CardsList
  1. HalluScore: Large Language Model Hallucination Question Answering Benchmark

    May 16, 2026Aisha Alansari, Hamzah LuqmanMultilingual Language Model EvaluationLLM Evaluation

  2. Uncertainty Quantification for Large Language Diffusion Models

    May 14, 2026Artem Vazhentsev, Vladislav Smirnov, David Li +3Uncertainty QuantificationLLM Hallucination Detection

  3. Scalable Token-Level Hallucination Detection in Large Language Models

    May 12, 2026Rui Min, Tianyu Pang, Chao Du +2LLM EvaluationHallucination in Language Models

  4. Instruction Lens Score: Your Instruction Contributes a Powerful Object Hallucination Detector for Multimodal Large Language Models

    May 12, 2026Runhe Lai, Xinhua Lu, Yanqi Wu +3Hallucination Detection in VLMsHallucination Detection

  5. OptArgus: A Multi-Agent System to Detect Hallucinations in LLM-based Optimization Modeling

    May 12, 2026Zhong Li, Zihan Guo, Xiaohan Lu +5LLM AuditingHallucination in Language Models

  6. Source or It Didn't Happen: A Multi-Agent Framework for Citation Hallucination Detection

    May 9, 2026Mingzhe Li, Zhiqiang Lin, Shiqing MaHallucination in Language ModelsCitation Verification

  7. Do Benchmarks Underestimate LLM Performance? Evaluating Hallucination Detection With LLM-First Human-Adjudicated Assessment

    May 8, 2026I. F. Atasoy, B. Mutlu, E. A. Sezer +1LLM EvaluationLLM-Assisted Annotation

  8. Sanity Checks for Long-Form Hallucination Detection

    May 8, 2026Geigh Zollicoffer, Minh Vu, Hongli Zhan +2LLM EvaluationHallucination Detection

  9. LLM hallucinations in the wild: Large-scale evidence from non-existent citations

    May 8, 2026Zhenyue Zhao, Yihe Wang, Toby Stuart +3LLM AuditingLLM Hallucination Detection

  10. Hallucination Detection via Activations of Open-Weight Proxy Analyzers

    May 8, 2026Akshita Singh, Prabesh Paudel, Siddhartha RoyHallucination in Language ModelsLLM Reliability

  11. Hallucination as an Anomaly: Dynamic Intervention via Probabilistic Circuits

    May 7, 2026Erik Nielsen, Elia Cunegatti, Marcus Vukojevic +1Probabilistic CircuitsLLM Hallucination Mitigation

  12. Attractor Geometry of Transformer Memory: From Conflict Arbitration to Confident Hallucination

    May 7, 2026Qiyao Liang, Risto Miikkulainen, Ila FieteMemorization in Language ModelsKnowledge Conflicts in Language Models

  13. The First Token Knows: Single-Decode Confidence for Hallucination Detection

    May 6, 2026Mina GabrielUncertainty QuantificationSelf-Consistency Decoding

  14. Text Corpora as Concept Fields: Black-Box Hallucination and Novelty Measurement

    May 6, 2026Nicholas S. Kersting, Vittorio Castelli, Chieh Ting Yeh +2LLM GroundingLLM Hallucination Detection

  15. MedFabric and EtHER: A Data-Centric Framework for Word-Level Fabrication Generation and Detection in Medical LLMs

    May 5, 2026Tung Sum Thomas Kwok, Qian Qian, Xiaofeng Lin +8HealthcareHallucination Detection

  16. Logical Consistency as a Bridge: Improving LLM Hallucination Detection via Label Constraint Modeling between Responses and Self-Judgments

    May 5, 2026Hao Mi, Qiang Sheng, Shaofei Wang +7Hallucination in Language ModelsLLM Hallucination Detection

  17. CuraView: A Multi-Agent Framework for Medical Hallucination Detection with GraphRAG-Enhanced Knowledge Verification

    May 5, 2026Severin Ye, Xiao Kong, Xiaopeng He +2HealthcareHallucination Detection

  18. A multilingual hallucination benchmark: MultiWikiQHalluA

    May 4, 2026Freja Thoresen, Dan Saattrup SmartMultilingual Language ModelsMultilingual Language Model Evaluation

  19. From Flat Facts to Sharp Hallucinations: Detecting Stubborn Errors via Gradient Sensitivity

    May 1, 2026Yee Zhing Liew, Andrew Huey Ping Tan, Anwar P. P. Abdul MajeedHallucination DetectionHallucination in Language Models