LLM Hallucination Detection

LLM: Large Language Model

Latest papers 141

All topics
CardsList
  1. The Labeling Problem in Hallucination Detection Benchmarks: An Empirical Evaluation

    Oct 6, 2026Jorma Valjakka, Juhani Kivimäki, Juha Mylläri +1LLM EvaluationLLM-as-a-Judge

  2. Single-Pass Uncertainty Heads for Claim-Level Hallucination Detection in Persian Medical Language Models

    Oct 2, 2026Mehrdad Ghassabi, Pedram Rostami, Hamidreza Baradaran Kashani +2Hallucination DetectionLLM Hallucination Detection

  3. External Observers May See More Clearly: Cross-Model Span-Level Hallucination Detection in Large Language Models via Hidden State Probing

    Oct 1, 2026Kingshuk Gupta, Davide BuscaldiHallucination DetectionLLM Hallucination Detection

  4. RAIM: Robust Aggregation of Inexpensive Models for Hallucination Detection

    Sep 30, 2026Elia Onofri, Roberto Di PietroLLM EvaluationLLM-as-a-Judge

  5. Halluscoring 2026: The first shared task on llms hallucination detection and answer verification

    Sep 29, 2026Aisha Alansari, Abdessalam Bouchekif, Ahmed Hasanaath +9LLM EvaluationLLM Answer Verification

  6. Attention Dispersion as a Diagnostic Signal for Hallucination in Large Language Models

    Sep 16, 2026Shardul P. More, Tanuja S. PawarHallucination DetectionLLM Hallucination Detection

  7. NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty Assessment

    Sep 12, 2026Guoqiang Zhang, Kexin Tan, Ming Zhang +12LLM EvaluationLLM Answer Verification

  8. Domain-Specific Hallucination Detection in Large Language Models

    Sep 12, 2026Varun Teja Chundru, Debasmita BiswasLanguage Model Error DetectionLLM Hallucination Mitigation

  9. Evidence-Aligned Entity Verification for Hallucination Detection in Retrieval-Augmented Generation

    Sep 8, 2026Runsong Jia, Zhen Fang, Mengjia Wu +2Hallucination DetectionLLM Hallucination Detection

  10. CodeTD: Topology of Attention Detects Hallucinations in Code LLMs

    Sep 7, 2026Daria Voronkova, Ilya Trofimov, Anton Dmitriev +3LLM Hallucination DetectionCode Generation Evaluation

  11. Beyond Majority Vote: Multi-Perspective Adjudication for Medical Hallucination Detection

    Sep 3, 2026Joe Cecil, Marjorie FreedmanLLM-as-a-JudgeFactual Consistency Evaluation

  12. HalluPeer: A Taxonomy-driven Benchmark for Detecting Hallucinations in Scientific Peer Reviews

    Sep 3, 2026Tzu-Ling Lin, Dong-Ting Yao, Teng-Fang Hsiao +2Hallucination DetectionScholarly Peer Review

  13. Enoki: Efficient Multi-Level Hallucination Detection

    Sep 1, 2026Elisei Rykov, Timur Ionov, Nikolay Ivanov +5Hallucination DetectionLLM Information Extraction

  14. SingProbe Technical Report

    Aug 31, 2026Sing TeamLanguage Model Safety EvaluationLLM Guardrails

  15. Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge

    Aug 29, 2026Saransh Kumar Gupta, Armaan Shah, Lipika Dey +2LLM AuditingLLM Reliability

  16. When Do Supervised UQ Ensembles Improve LLM Hallucination Detection? A Robustness Study

    Aug 25, 2026Mohit Singh Chauhan, Vipin Gyanchandani, Dylan BouchardLLM Hallucination DetectionLLM Uncertainty Estimation

  17. Decomposed Entailment for Factuality Checking and Hallucination Detection

    Aug 6, 2026Achir Oukelmoun, Nasredine Semmar, Gaël De ChalendarLLM GroundingClaim Verification

  18. Tracing the Cascade: A Topology-Aware Evaluation Framework for Scientific Agent Hallucinations

    Aug 1, 2026Xinshun Feng, Ziqi Miao, Lijun Li +1AI Agents for Scientific DiscoveryHallucination in Language Models

  19. D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models

    Jul 27, 2026Bianca Raimondi, Davide Evangelista, Maurizio Gabbrielli +1Language Model Error DetectionHallucination in Language Models

  20. Reasoning Denoiser: Denoising Reasoning Traces for Hallucination Detection in Large Reasoning Models

    Jul 24, 2026Junlin Fang, Do Nguyen-Thanh, Xiaogang Xu +2LLM Hallucination DetectionLarge Reasoning Models