Multimodal Hallucination

Latest papers 37

All topics
CardsList
  1. OmniConfess: Eliciting Token Confessions to Mitigate Omni-Modal Hallucination

    Oct 2, 2026Huiqiang Rong, Haoran Luo, Hui Feng +4Multimodal Large Language ModelsMultimodal Hallucination

  2. Omni-Streaming Thinking

    Sep 14, 2026Enjun Du, Siyi Liu, Ziyu Zheng +4Audio-Visual UnderstandingStreaming Video Understanding

  3. OmniHallu: Unified Hallucination Detection for Cross-Modal Comprehension and Generation in Multimodal Large Language Models

    Sep 11, 2026Jianjiang Yang, Peihang Li, Shanqing Xu +3Hallucination Detection in VLMsHallucination Detection

  4. KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluation

    Aug 4, 2026Ruihan Li, Jiyang Tan, Kailin Jiang +5Multimodal HallucinationMultimodal Model Evaluation

  5. HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

    Jul 23, 2026Weilin Jin, Mingyu Wang, Wenbo Li +5Hallucination Detection in VLMsMultimodal Hallucination

  6. No Place to Hide: Benchmarking Video Hallucination with Background-Controlled Pairs

    Jun 30, 2026Haojian Huang, Harold Haodong Chen, Meng Luo +6VLM EvaluationMultimodal Hallucination

  7. Omni-Perception Policy Optimization for Multimodal Emotion Reasoning

    Jun 24, 2026Zhiyuan Han, Beier Zhu, Wenwen Tong +6Multimodal ReasoningMultimodal Hallucination

  8. SAGE: An Expert-Annotated South Asian GI Endoscopy Dataset for Multimodal Learning and Hallucination Analysis

    Jun 20, 2026Niyoj Oli, Sachin Acharya, Sandesh Pokhrel +7EndoscopyMedical Imaging

  9. MODE-RAG: Manifold Outlier Diagnosis and Energy-based Retrieval-Augmented Generation Evaluation

    Jun 16, 2026Zehang Wei, Jiaxin Dai, Jiamin Yan +1Multimodal RAGMulti-Agent LLM Systems

  10. ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning

    Jun 12, 2026Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5Multimodal HallucinationClinical Reasoning

  11. Bridging Modal Isolation in Interleaved Thinking: Supervising Modality Transitions via Stepwise Reinforcement

    Jun 11, 2026Tingyu Li, Le Zhou, Siyuan Li +5Cross-Modal AlignmentMultimodal Reasoning

  12. ChronoPhyBench: Do MLLMs Truly Understand the World or Merely Exploit Language Priors?

    Jun 6, 2026Bin Zhu, Yanhao Jia, Kexin Zhao +12Physical ReasoningMultimodal QA

  13. MM-Snowball: Evaluating and Mitigating Hallucination Snowballing in Multimodal Multi-Turn Dialogue

    May 30, 2026Yue Jiang, Xue Jiang, Lihua Zhang +6Multimodal Large Language ModelsMultimodal Hallucination

  14. Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization

    May 27, 2026Jiawei Kong, Hao Fang, Shunxiang Liao +5Multimodal GroundingDirect Preference Optimization

  15. Hallucination Behavior in Multimodal LLMs Across Agricultural Image Interpretation and Generation Tasks

    May 26, 2026Partho Ghose, Al Bashir, Prem Raj +1Agricultural Image AnalysisVLM Hallucination

  16. Causal Evidence for Attention Head Imbalance in Modality Conflict Hallucination

    May 19, 2026Jinrui Jiang, Zhangtai Wu, Zhen Wu +1Hallucination in Language ModelsMultimodal Large Language Models

  17. Hallucination as Exploit: Evidence-Carrying Multimodal Agents

    May 18, 2026Guijia Zhang, Hao Zheng, Harry YangAI Agent SecurityMultimodal Hallucination

  18. How do Humans Process AI-generated Hallucination Contents: a Neuroimaging Study

    May 16, 2026Shuqi Zhu, Yi Zhong, Ziyi Ye +4Hallucination DetectionHallucination in Language Models

  19. When Vision Speaks for Sound

    May 13, 2026Xiaofei Wen, Wenjie Jacky Mo, Xingyu Fu +6Audio-Language Model EvaluationAudio-Visual Understanding

  20. When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs

    May 12, 2026Fanpu Cao, Xin Zou, Xuming Hu +1Hallucination Detection in VLMsHallucination in Language Models

  21. Omni-Persona: Systematic Benchmarking and Improving Omnimodal Personalization

    May 11, 2026Yeongtak Oh, Dongwook Lee, Sangkwon Park +2Multimodal GroundingMultimodal Large Language Models

  22. Separate First, Fuse Later: Mitigating Cross-Modal Interference in Audio-Visual LLMs Reasoning with Modality-Specific Chain-of-Thought

    May 11, 2026Xuanchen Li, Yuheng Lu, Chenrui Cui +6Cross-Modal LearningMultimodal QA

  23. TraceAV-Bench: Benchmarking Multi-Hop Trajectory Reasoning over Long Audio-Visual Videos

    May 8, 2026Hengyi Feng, Hao Liang, Mingrui Chen +6Audio-Visual UnderstandingMultimodal Hallucination

  24. Mitigating Multimodal LLMs Hallucinations via Relevance Propagation at Inference Time

    May 3, 2026Itai Allouche, Joseph KeshetMultimodal GroundingInference-Time Optimization

  25. Self-Captioning Multimodal Interaction Tuning: Amplifying Exploitable Redundancies for Robust Vision Language Models

    May 3, 2026Yuriel Ryan, Hei Man Ip, Adriel Kuek +2VLM RobustnessMultimodal Hallucination

  26. DualFact+: A Multimodal Fact Verification Framework for Procedural Video Understanding

    Apr 28, 2026Cennet Oguz, Yasser Hamidullah, Josef van Genabith +1Multimodal GroundingVideo Understanding

  27. Exploring Audio Hallucination in Egocentric Video Understanding

    Apr 26, 2026Ashish Seth, Xinhao Mei, Changsheng Zhao +9Audio-Visual UnderstandingHallucination in Language Models

  28. HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models

    Apr 21, 2026Feiyu Zhao, Yiming Chen, Wenhuan Lu +3Audio-Language Model EvaluationAudio-Language Model Hallucination Detection

  29. Mitigating Multimodal Hallucination via Phase-wise Self-reward

    Apr 20, 2026Yu Zhang, Chuyang Sun, Kehai Chen +3Vision-Language ModelsHallucination in Language Models

  30. Do Multimodal LLMs See Before They Read? Diagnosing Contextual Sycophancy

    Date pendingYi-Cheng Lai, Hen-Hsen HuangLLM SycophancyEvidence-Grounded Reasoning

  31. MAD: Modality-Adaptive Decoding for Mitigating Cross-Modal Hallucinations in Multimodal Large Language Models

    Date pendingSangyun Chung, Se Yeon Kim, Youngchae Chee +1Multimodal RobustnessHallucination in Language Models