VLM Hallucination Mitigation

VLM: Vision-Language Model

Latest papers 131

All topics
CardsList
  1. FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models

    Jun 28, 2026Yichen Guo, Kai Tang, Fenglai Lin +5Vision-Language ModelsLarge Vision-Language Models

  2. Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding

    Jun 25, 2026Liu Yu, Can Chen, Ping Kuang +3Object Hallucination in VLMsFaithfulness in VLMs

  3. Paying More Attention to Visual Tokens in Self-Evolving Large Multimodal Models

    Jun 25, 2026Shravan Venkatraman, Ritesh Thawkar, Omkar Thawakar +4Multimodal Large Language ModelsVLM Reasoning

  4. TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation

    Jun 25, 2026Zhixiang Lu, Xiwei Liu, Sifan Song +5Radiology Report GenerationMedical VLMs

  5. Enhancing Brain MRI Anomaly Detection and Reasoning with ROI Rethink and Synthetic Data

    Jun 24, 2026Shangkun Li, Jie Xu, Yi Guo +2Medical Image Anomaly DetectionVLM Reasoning

  6. E-MRL: Cross-view Aligned Evidence-driven Multimodal Reinforcement Learning for Reliable 3D Tumor Analysis

    Jun 22, 2026Sijing Li, Zhongwei Qiu, Zhuoya Wang +6Medical Image GroundingVLM Hallucination Mitigation

  7. Mind the Heads: Topological Representation Alignment for Multimodal LLMs

    Jun 22, 2026Davide Caffagni, Alberto Compagnoni, Federico Melis +5Cross-Modal AlignmentMultimodal Large Language Models

  8. CFPO: Counterfactual Policy Optimization for Multimodal Reasoning

    Jun 22, 2026Zhangyuan Yu, Wanran Sun, Guangjing Yang +2Multimodal ReasoningVLM Hallucination Mitigation

  9. Improving Reasoning in Vision-Language Models via Perception Verified Self-Training

    Jun 20, 2026Sourabh Sharma, Sonam Gupta, SadbhawnaVLM ReasoningVLM Hallucination Mitigation

  10. Spectral Query-Key Product Weight Steering for Training-Free VLM Hallucination Mitigation

    Jun 18, 2026Karn Tiwari, Varnith Chordia, Prathosh A PObject Hallucination in VLMsVLM Hallucination Mitigation

  11. Hallucination Detection and Correction in Medical VLMs via Counter-Evidence Verification

    Jun 17, 2026Nan Zhou, Ke Zou, Meng Liu +5Hallucination Detection in VLMsVision-Language Models

  12. CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework

    Jun 16, 2026Sneha Rao, Shaina Raza, Dhanesh RamachandramVLM EvaluationVision-Language Grounding

  13. MODE-RAG: Manifold Outlier Diagnosis and Energy-based Retrieval-Augmented Generation Evaluation

    Jun 16, 2026Zehang Wei, Jiaxin Dai, Jiamin Yan +1Multimodal RAGMulti-Agent LLM Systems

  14. Look Again Before You Abstain:Budgeted Conformal Evidence Acquisition for Reliable Vision-Language Model

    Jun 15, 2026Jian Xu, Delu Zeng, John Paisley +1Hallucination Detection in VLMsActive Perception

  15. The Truth Stays in the Family: Enhancing Contextual Grounding via Inherited Truthful Heads in Model Lineages

    Jun 14, 2026Miso Choi, Seonga Choi, Mincheol Kwon +3LLM GroundingLLM Interpretability

  16. Mitigating Visual Hallucinations in Multimodal Systems through Retrieval-Augmented Reliability-Aware Inference

    Jun 14, 2026Pratheswaran Hariharan, Haiping Xu, Donghui YanProbability CalibrationSelective Prediction

  17. Analyzing and Improving Fine-grained Preference Optimization in Medical LVLMs

    Jun 10, 2026Shayan Mohammadizadehsamakosh, Pritam Sarkar, Leonid Sigal +2Medical VLMsMedical Image Grounding

  18. MultiToP: Learning to Patch Visual Tokens to Mitigate Hallucinations in Video Large Multimodal Models

    Jun 10, 2026Yuansheng Gao, Wenbin Xing, Jiahao Yuan +4Video-Language ModelsMultimodal Foundation Models

  19. Disentangling Hallucinations: Orthogonal Semantic Projection for Robust Interpretability

    Jun 8, 2026Emirhan Bilgiç, Baptiste Caramiaux, Zhi Yan +1VLM InterpretabilityMultimodal Model Interpretability

  20. MAGIS: Evidence-Based Multi-Agent Reasoning for Interpretable Strabismus Clinical Decision-Making

    Jun 8, 2026Xikai Tang, Yifan Wang, Jiafan Zhuang +12Medical DiagnosisMedical VLMs

  21. P2^2-DPO: Grounding Hallucination in Perceptual Processing via Calibration Direct Preference Optimization

    Jun 2, 2026Ruipeng Zhang, Zhihao Li, Haozhang Yuan +2VLM RobustnessDirect Preference Optimization

  22. Steer Where It Matters: Token-Level Visual-Sensitivity Steering for LVLMs Hallucination Mitigation

    Jun 2, 2026Ruipeng Zhang, Zhihao Li, C. L. Philip Chen +1VLM HallucinationLarge Vision-Language Models

  23. Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation

    Jun 2, 2026Boyuan Xiao, Bohong Chen, Yumeng Li +3Vision-Language-Action ModelsVLMs for Robotics

  24. Mitigating Manifold Departure: Uncertainty-Aware Subspace Rectification for Trustworthy MLLM Decoding

    May 31, 2026Yingxuan Zhuang, Jingxiao Yang, Miao Pan +7Object Hallucination in VLMsVLM Hallucination Mitigation

  25. Ask4VG: Risk-Aware Question Selection for Reducing Prior-Driven Answers in Medical VQA

    May 31, 2026Xiaorong Zhu, Qiang Li, Zibo Xu +2Medical VQAVLM Hallucination Mitigation

  26. MM-Snowball: Evaluating and Mitigating Hallucination Snowballing in Multimodal Multi-Turn Dialogue

    May 30, 2026Yue Jiang, Xue Jiang, Lihua Zhang +6Multimodal Large Language ModelsMultimodal Hallucination