LLM Hallucination Detection

LLM: Large Language Model

Latest papers 141

All topics
CardsList
  1. HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

    Jul 23, 2026Weilin Jin, Mingyu Wang, Wenbo Li +5Hallucination Detection in VLMsMultimodal Hallucination

  2. HalluTruthQA: A Fine-Grained Benchmark for Hallucination Detection, Localization, and Explanation in Arabic Question Answering

    Jul 22, 2026Abdessalam Bouchekif, Mohammed-En-Nadhir Zighem, Salah Eddine Bekhouche +9Arabic NLPLLM Answer Verification

  3. HALLMARK: Diagnosing Three Failure Modes in LLM Citation Verifiers

    Jul 20, 2026Patrik Reizinger, Wieland BrendelLLM EvaluationCitation Verification

  4. Diversity-Oriented Fine-Tuning for Uncertainty-Based Hallucination Detection

    Jul 18, 2026Qiuyuan Li, Hongliang Dai, Piji LiFine-TuningLLM Hallucination Detection

  5. ASK-NN: An Asymmetric Nearest-Neighbor Test that detects Distribution Drifts in Natural Language

    Jul 17, 2026Sergey Zakharov, Rodion Oblovatny, Alexey ZaytsevTwo-Sample TestingAI-Generated Text Detection

  6. Hallucination Detection in Large Language Models Using Diversion Decoding

    Jul 11, 2026Basel Abdeen, S M Tahmid Siddiqui, Meah Tahmeed Ahmed +4Hallucination in Language ModelsLLM Hallucination Detection

  7. Towards Detecting Inconsistencies in End-to-end Generated TODs

    Jul 10, 2026Tiziano Labruna, Giovanni Bonetta, Bernardo MagniniLLM Hallucination DetectionConversational Agents

  8. Hallucination Self-Play: Bootstrapping Reinforced Detector via Evolved Generator

    Jul 8, 2026Shiping Yang, Shining Liang, Weihao Liu +4LLM Hallucination DetectionSynthetic Data Generation for Language Models

  9. A Unified Detection Framework for AI-Related Content and Artifacts

    Jul 8, 2026Xifeng Zhang, Tao Hu, Yijie Peng +1AI-Generated Text DetectionLLM Hallucination Detection

  10. Detecting Hallucinations in Retrieval-Augmented Generation through Grounding-Aware Sensitivity by Perturbation (GASP)

    Jul 5, 2026Mohamed Aly BoukeRetrieval-Augmented GenerationLLM Grounding

  11. CrossHallu: Do Hallucination Signals Generalize Across Languages and Domains in Large Language Model's Internals?

    Jul 4, 2026Aisha Alansari, Malak Alkhorasani, Hamzah LuqmanMultilingual Language Model EvaluationLLM Hallucination Detection

  12. Beyond Document Grounding: Span-Level Hallucination Detection over Code, Tool Output, and Documents

    Jul 1, 2026Ádám Kovács, Bowei He, Xue Liu +3LLM GroundingHallucination Detection

  13. Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences

    Jul 1, 2026Mark Russinovich, Ram Shankar Siva Kumar, Ahmed SalemHallucination in Language ModelsCitation Verification

  14. Readable but Not Controllable: Neuron-Level Evidence for Medical LLM Hallucination

    Jun 30, 2026Vijay Vankadaru, Asha Matthews, Tanya Roosta +1LLM Hallucination MitigationLLM Interpretability

  15. AURORA: Asymmetry and Update-Induced Rotation for Robust Hallucination Detection in Large Language Models

    Jun 28, 2026Zishuai Zhang, Hainan Zhang, Zhiming ZhengHallucination in Language ModelsLLM Hallucination Detection

  16. MedBench v5: A Dynamic, Process-Oriented, and Hallucination-Aware Benchmark for Clinical Multimodal Models

    Jun 23, 2026Jinru Ding, Chuchu Jiang, Lu Lu +12AI Agent BenchmarksMedical VLMs

  17. LegalHalluLens: Typed Hallucination Auditing and Calibrated Multi-Agent Debate for Trustworthy Legal AI

    Jun 16, 2026Lalit Yadav, Akshaj GurugubelliLLM Hallucination MitigationMulti-Agent Debate

  18. Zero-source LLM Hallucination Detection with Human-like Criteria Probing

    Jun 11, 2026Jiahao Yang, Shuhai Zhang, Hailong Kang +3Hallucination DetectionLLM Hallucination Detection