LLM Hallucination Detection

LLM: Large Language Model

Latest papers 141

All topics
CardsList
  1. CARE: A Conformal Safety Layer for Medical Summarization

    Jun 8, 2026Suhana Bedi, Bridget Lin, Anson Y. Zhou +5Text SummarizationConformal Risk Control

  2. Constrained Paraphrase Consistency for LLM Hallucination Detection

    Jun 6, 2026Shanshan Lin, Dongsheng Hong, Sibo Ju +3LLM ReliabilityLLM Hallucination Detection

  3. Cross Paraphrastic Invariance Learning for Hallucination Detection

    Jun 6, 2026Shanshan Lin, Dongsheng Hong, Sibo Ju +3Contrastive LearningLLM Grounding

  4. OpenHalDet: A Unified Benchmark for Hallucination Detection across Diverse Generation Scenarios

    Jun 5, 2026Xinyi Li, Zhen Fang, Yongxin Deng +12LLM EvaluationHallucination Detection

  5. Med-HEAL: Analyzing and Mitigating Hallucinations in Medical LLMs with Hallucination-Aware In-Context Learning

    May 31, 2026Yiming Liao, Zeno Franco, Jose Eduardo Lizarraga Mazaba +1LLM Self-CorrectionLLM Hallucination Mitigation

  6. TriLens: Per-Layer Logit-Lens Entropy for White-Box Hallucination Detection

    May 31, 2026Bohan Yang, Yijun Gong, Zhi Zhang +3Language Model Error DetectionLLM Reliability

  7. KG-Guard: Graph-Based Hallucination Detection for Knowledge Base Question Answering

    May 29, 2026Albert Sawczyn, Piotr Bielak, Tomasz KajdanowiczLLM Hallucination DetectionKnowledge Graph Question Answering

  8. FLaG: Fine-Grained Latent Grouping for Hallucination Detection

    May 29, 2026Wentao Ye, Liyao Li, Zhiqing Xiao +6Latent Variable ModelsLLM Hallucination Detection

  9. Protocol for evaluating ChatGPT in biomedical association generation and verification using a RAG-enabled, cross-model majority voting workflow

    May 28, 2026Ahmed Abdeen Hamed, Luis M. RochaLLM EvaluationLLM Answer Verification

  10. K-FinHallu: A Hallucination Detection Benchmark for Multi-Turn RAG in Korean Finance

    May 28, 2026Eunbyeol Cho, Yunseung Lee, Mirae Kim +3Retrieval-Augmented GenerationHallucination in Language Models

  11. Entropy Distribution as a Fingerprint for Hallucinations in Generative Models

    May 27, 2026Mattia J. Villani, Pranav Deshpande, Akshay Seshadri +2Language Model Error DetectionLanguage Model Generation Evaluation

  12. Chain-based Adaptive Reconfiguration Over Lattices for Hallucination Reduction

    May 26, 2026Joan Vendrell Gallart, Solmaz Kia, Russell Bent +1LLM Hallucination MitigationHallucination in Language Models

  13. CiteCheck: Retrieval-Grounded Detection of LLM Citation Hallucinations in Scientific Text

    May 26, 2026Khashayar Khajavi, Shaghayegh Sadeghi, Rise Adhikari +1Citation VerificationAutomated Fact-Checking

  14. QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents

    May 26, 2026Ye Yuan, Rui Song, Weien Li +12Social Deduction GamesLLM Agent Evaluation

  15. Evaluating the Relevance of Uncertainty Estimators for LLM Hallucination

    May 26, 2026Yedidia Agnimo, Anna Korba, Annabelle Blangero +2LLM EvaluationHallucination in Language Models

  16. Neuro-Symbolic Verification of LLM Outputs for Data-Sensitive Domains (extended preprint)

    May 26, 2026Paul Sigloch, Christoph BenzmüllerLLM Answer VerificationLLM Hallucination Detection

  17. Automatic Layer Selection for Hallucination Detection

    May 25, 2026Xinpeng Wang, William X. Cao, Andrew Gordon Wilson +1Hallucination in Language ModelsLLM Hallucination Detection

  18. Why LLMs Hallucinate on Structured Knowledge: A Mechanistic Analysis of Reasoning over Linearized Representations

    May 25, 2026Shanghao Li, Jinda Han, Yibo Wang +5LLM GroundingLLM Interpretability

  19. MultiHaluDet: Multilingual Hallucination Detection via LLM Hidden State Probing

    May 24, 2026Riasad Alvi, Nurul Labib Sayeedi, Md. Faiyaz Abdullah SayeediHallucination DetectionHallucination in Language Models

  20. Empirical Analysis and Detection of Hallucinations in LLM-Generated Bug Report Summaries

    May 22, 2026Hinduja Nirujan, Shreyas Patil, Abdallah Ayoub +2Software EngineeringText Summarization

  21. Graph Alignment Topology as an Inductive Bias for Grounding Detection

    May 21, 2026Paul Landes, Pranav Herur, Adam Cross +1LLM GroundingHallucination in Language Models

  22. Do No Harm? Hallucination and Actor-Level Abuse in Web-Deployed Medical Large Language Models

    May 20, 2026Sunday Oyinlola Ogundoyin, Muhammad Ikram, Rahat MasoodLanguage Model Safety EvaluationHealthcare

  23. HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models

    May 19, 2026Emmy Liu, Varun Gangal, Michael Yu +4LLM EvaluationHallucination in Language Models

  24. Position: Uncertainty Quantification in LLMs is Just Unsupervised Clustering

    May 19, 2026Tiejin Chen, Longchao Da, Xiaoou Liu +1LLM EvaluationUncertainty Quantification