Hallucination in Language Models

Latest papers 187

All topics
CardsList
  1. HalluTruthQA: A Fine-Grained Benchmark for Hallucination Detection, Localization, and Explanation in Arabic Question Answering

    Jul 22, 2026Abdessalam Bouchekif, Mohammed-En-Nadhir Zighem, Salah Eddine Bekhouche +9Arabic NLPLLM Answer Verification

  2. Protective Capacity Hallucination: When Large Language Models Claim Nonexistent Capabilities

    Jul 15, 2026Eunna Lee, Jungpyo Nam, Sunjun HwangLanguage Model Safety EvaluationHallucination in Language Models

  3. Hallucination Detection in Large Language Models Using Diversion Decoding

    Jul 11, 2026Basel Abdeen, S M Tahmid Siddiqui, Meah Tahmeed Ahmed +4Hallucination in Language ModelsLLM Hallucination Detection

  4. Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization

    Jul 7, 2026Kaishen Wang, Tong Zheng, Xuehao Cui +3LLM Hallucination MitigationRL for Language Model Reasoning

  5. Knowledge Knows, Verbalization Tells: Disentangling Latent Directions for Mathematical Solvability in LLMs

    Jul 6, 2026Nikolaos Xiros, Maria-Eleni Zoumpoulidi, Georgios ParaskevopoulosHallucination in Language ModelsRepresentation Geometry in Language Models

  6. Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences

    Jul 1, 2026Mark Russinovich, Ram Shankar Siva Kumar, Ahmed SalemHallucination in Language ModelsCitation Verification

  7. AURORA: Asymmetry and Update-Induced Rotation for Robust Hallucination Detection in Large Language Models

    Jun 28, 2026Zishuai Zhang, Hainan Zhang, Zhiming ZhengHallucination in Language ModelsLLM Hallucination Detection

  8. Agent vs. Parametric World Models: Hybrid Planning for Reliable Language Agents

    Jun 26, 2026Xinyuan Song, Zekun CaiWorld ModelsWorld Model-Based Planning

  9. From Signals to Transfer: A Factorised Study of Probe-Based Uncertainty Estimation in Large Language Models

    Jun 26, 2026Ponhvoan Srey, Xiaobao Wu, Cong-Duy Nguyen +3Uncertainty QuantificationHallucination in Language Models

  10. Not All Claims Are Equally Risky: FACTOR for Adaptive Verification in Factual Long-Form Generation

    Jun 21, 2026Areeba Hassan, Arooj Kausar, Syeda Kisaa Fatima +2LLM Answer VerificationLong-Form Document Generation

  11. Finetuning with Scientific Data Increases Hallucinations: A Multi-domain Factuality Evaluation of LLMs

    Jun 19, 2026Raia Abu Ahmad, Nikolas Rauscher, Ekaterina Borisova +3LLM EvaluationLLM Fine-Tuning

  12. When AI Says "I have been in similar situations": Synthetic Lived Experience in Peer-Like Caregiver Support

    Jun 16, 2026Drishti Goel, Agam Goyal, Veda Duddu +6Emotional Support ConversationHealthcare

  13. Failure Modes of Large Language Models on Research-Level Mathematics: A Taxonomy and an Empirical Characterisation

    Jun 12, 2026Arnesh Banerjee, Ayushi BhattacharjeeMathematical Reasoning BenchmarksLLM Auditing

  14. PhantomBench: Benchmarking the Non-existential Threat of Language Models

    Jun 9, 2026Haeji Jung, Hila GonenLLM EvaluationHallucination in Language Models

  15. Analyzing the Correlation Between Hallucinations and Knowledge Conflicts in Large Language Models

    Jun 7, 2026Lucrezia Laraspata, Giovanna Castellano, Gennaro VessioKnowledge Conflicts in Language ModelsLLM Interpretability

  16. What's in a Name? Morphological Shortcuts by LLMs in Pharmacology

    Jun 4, 2026Kaijie Mo, Thomas Yang, Chantal Shaib +6Hallucination in Language ModelsLanguage Modeling

  17. Conformal Language Modeling via Posterior Sampling

    Jun 2, 2026Nicolas Emmenegger, Theo X. Olausson, Armando Solar-Lezama +1Hallucination in Language ModelsConformal Prediction

  18. Hallucinations as Orthogonal Noise: Inference-Time Manifold Alignment via Dynamic Contextual Orthogonalization

    Jun 2, 2026Mingkuan Zhao, Wentao Hu, Tianchen Huang +6LLM Hallucination MitigationHallucination in Language Models

  19. The Ghost Couple: Correlated LLM Name Priors and Their Haunting of the Web and Academic Publishing

    Jun 1, 2026Michał Brzozowski, Neo Christopher ChungLLM AuditingHallucination in Language Models