VLM Hallucination Mitigation

VLM: Vision-Language Model

Latest papers 131

All topics
CardsList
  1. When Model Priors Conflict with Visual Evidence: Mitigating Commonsense-Driven Hallucinations by Selective Prior Calibration

    Jul 31, 2026Kesheng Chen, Yamin Hu, Wenjian LuoVLM HallucinationVLM Calibration

  2. CAER: Conflict-Aware Evidence Routing with Dual Prefix Experts for Multimodal Large Language Models

    Jul 31, 2026Zixuan Liu, Juntao Cai, Xiaoxu Cai +2Mixture of ExpertsMultimodal Large Language Models

  3. Hallucinations Leave a Grounding Signature:Verifier-Guided Decoding for Selective Object Correction

    Jul 30, 2026Lei Yang, Xinze Liu, Dayan Wu +7Hallucination Detection in VLMsLLM Hallucination Mitigation

  4. Explainable and Resource-Efficient Spatial Reasoning in Multimodal LLMs for Decision-Critical Applications

    Jul 29, 2026Piyush Jain, Kousik Dasgupta, Rajarshi Roy +1Visual Spatial Reasoning3D Spatial Reasoning

  5. Towards Faithful Sentimental Image Captioning via Evidence-Aware Multi-Agent Reasoning

    Jul 28, 2026Tiecheng Cai, Zexian Yang, Chao Chen +2Image CaptioningVision-Language Grounding

  6. Rethinking CD: A Reproducibility Study and Extension on the Ineffectiveness of Contrastive Decoding at Mitigating Object Hallucinations in MLLMs

    Jul 28, 2026Arnav Bendre, Guneesh Gupta, Kavish Grover +2Object Hallucination in VLMsMultimodal Large Language Models

  7. Disentangling Semantic Attention from Structural Bias in the Attention Manifold

    Jul 27, 2026Pengkun Jiao, Bin Zhu, Jingjing Chen +1Object Hallucination in VLMsMultimodal Large Language Models

  8. DICA: Dual-Indicator Guided Contrastive Alignment in Multimodal Large Language Models

    Jul 27, 2026Hao Yang, Jin Wang, Xuejie ZhangLLM AlignmentMultimodal Large Language Models

  9. HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

    Jul 23, 2026Weilin Jin, Mingyu Wang, Wenbo Li +5Hallucination Detection in VLMsMultimodal Hallucination

  10. Geo3R: Mitigating Spatial Reasoning Hallucination in Multimodal Large Language Models

    Jul 23, 2026Mingyu Wang, Weilin Jin, Wenbo Li +33D Spatial ReasoningHallucination in Language Models

  11. ProCap: Prominence-guided Object Rectification for Faithful and Comprehensive Video Captioning

    Jul 23, 2026Debjyoti Das Adhikary, Aritra Hazra, Partha Pratim ChakrabartiVideo CaptioningVision-Language Grounding

  12. Visual Token Compression Enhances Robustness of MLLMs

    Jul 21, 2026Shishen Gu, Jiequan Cui, Wenbo Hu +3VLM RobustnessAdversarial Attacks on VLMs

  13. MissingBench-Verified: Probing Vision-Language Models' Inability to Detect Missing Object Parts

    Jul 21, 2026Wenqi Marshall Guo, Qingyun Qian, Shiyu Zhou +2VLM EvaluationObject Hallucination in VLMs

  14. Look Clearly Before Answering: Mitigating Hallucinations in LVLMs via Saliency-Driven Perceptual Realignment

    Jul 18, 2026Pengxu Chen, Yao Zhu, Guangming Zhu +4Large Vision-Language ModelsVLM Hallucination Mitigation

  15. Groc-PO: Grounded Context Preference Optimization for Truthful Multimodal LLMs

    Jul 15, 2026Zhixiao Zheng, Zheren Fu, Zhiyuan Yao +3Multimodal GroundingMultimodal Large Language Models

  16. Mixture of Cognitive Experts in Large Vision-Language Models

    Jul 12, 2026Robert Wijaya, Ngai-Man CheungVision-Language ModelsLarge Vision-Language Models

  17. VaseMuseum: Digital Intelligent Museum for Ancient Greek Pottery

    Jul 7, 2026Jiazi Wang, Nonghai Zhang, Qiushi Xie +5Multimodal RAGCultural Heritage

  18. SeeMe: Mitigating Hallucinations in Large Vision-Language Models through Effective Visual Token Engineering

    Jul 5, 2026Kai Tang, Jinhao You, Bohua Zhang +6Large Vision-Language ModelsObject Hallucination in VLMs

  19. ESC: Emotional Self-Correction for Reliable Vision-Language Models

    Jul 1, 2026Tien-Huy Nguyen, Minh-Nhat Nguyen, Nguyen Nhat Huy +9LLM Self-CorrectionVLM Reasoning

  20. Information-Regularized Attention for Visual-Centric Reasoning

    Jul 1, 2026Guohao Sun, Xiaofang Wang, Yash Patel +3VLM RobustnessVision-Language Grounding

  21. Synergistic Perception-Reasoning Governance: Grounding Medical MLLMs with Verifiable Anatomical Evidence

    Jun 30, 2026Rui Hao, Qiankun Li, Junyuan Mao +4Radiology Report GenerationMedical VQA

  22. ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs

    Jun 30, 2026Zhiyuan Yao, Zheren Fu, Zhixiao Zheng +3Cross-AttentionDirect Preference Optimization

  23. See Only When Needed: Context-Aware Attention Intervention for Mitigating Hallucinations in LVLMs

    Jun 29, 2026Yuqing Lei, Wenbo Lyu, Yingjun Du +3Visual AttentionLarge Vision-Language Models