Object Hallucination in VLMs

VLM: Vision-Language Model

Latest papers 84

All topics
CardsList
  1. Instruction Lens Score: Your Instruction Contributes a Powerful Object Hallucination Detector for Multimodal Large Language Models

    May 12, 2026Runhe Lai, Xinhua Lu, Yanqi Wu +3Hallucination Detection in VLMsHallucination Detection

  2. Mitigating Action-Relation Hallucinations in LVLMs via Relation-aware Visual Enhancement

    May 12, 2026Zhenxin Qin, Qiang Li, Qingzhuo Wang +3VLM RobustnessVLM Hallucination

  3. Tracking the Truth: Object-Centric Spatio-Temporal Monitoring for Video Large Language Models

    May 9, 2026Tri Cao, Khoi Le, Thong Nguyen +7VLM EvaluationObject Hallucination in VLMs

  4. When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models

    May 7, 2026Harshvardhan Saini, Samyak Jha, Yiming Tang +1Vision-Language ModelsObject Hallucination in VLMs

  5. Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models

    May 6, 2026Huatian Zhang, Zhendong Mao, Lei Zhang +1LLM AlignmentDirect Preference Optimization

  6. CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering

    May 6, 2026Qiming Li, Zekai Ye, Xiaocheng Feng +9Hallucination in Language ModelsLarge Vision-Language Models

  7. Information Coordination as a Bridge: A Neuro-Symbolic Architecture for Reliable Autonomous Driving Scene Understanding

    May 6, 2026Shuo Liu, Lei Shi, Haowen Liu +3Object Hallucination in VLMsAutonomous Driving Perception

  8. Perceptual Flow Network for Visually Grounded Reasoning

    May 4, 2026Yangfu Li, Yuning Gong, Hongjian Zhan +8Object Hallucination in VLMsVLM Reasoning

  9. Online Self-Calibration Against Hallucination in Vision-Language Models

    May 1, 2026Minghui Chen, Chenxu Yang, Hengjie Zhu +3Vision-Language ModelsHallucination in Language Models

  10. Instruction-Evidence Contrastive Dual-Stream Decoding for Grounded Vision-Language Reasoning

    Apr 28, 2026Yashwant Pravinrao Bangde, Debaditya RoyObject Hallucination in VLMsVision-Language Grounding

  11. Improving Vision-language Models with Perception-centric Process Reward Models

    Apr 27, 2026Yingqian Min, Kun Zhou, Yifan Li +6Process Reward ModelsObject Hallucination in VLMs

  12. Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation

    Apr 27, 2026Yubo Jiang, Xin Yang, Abudukelimu Wuerkaixi +7Hallucination in Language ModelsObject Hallucination in VLMs

  13. R-CoV: Region-Aware Chain-of-Verification for Alleviating Object Hallucinations in LVLMs

    Apr 22, 2026Jiahao Xie, Alessio Tonioni, Nathalie Rauschmayr +2Hallucination Detection in VLMsVision-Language Models

  14. Breaking the Illusion: When Positive Meets Negative in Multimodal Decoding

    Apr 22, 2026Yubo Jiang, Yitong An, Xin Yang +7Vision-Language ModelsHallucination in Language Models

  15. VCE: A zero-cost hallucination mitigation method of LVLMs via visual contrastive editing

    Apr 21, 2026Yanbin Huang, Yisen Li, Guiyao Tie +6Large Vision-Language ModelsObject Hallucination in VLMs

  16. LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models

    Apr 20, 2026Zhiyuan Jiang, Weihao Hong, Xinlei Guan +8VLM EvaluationHallucination Detection in VLMs

  17. DO-Bench: An Attributable Benchmark for Diagnosing Object Hallucination in Vision-Language Models

    Apr 18, 2026JiYang Wang, Jiawei Chen, Mengqi Xiao +3VLM EvaluationHallucination Detection in VLMs

  18. Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs

    Apr 17, 2026Sai Srinivas Kancheti, Aditya Sanjiv Kanade, Vineeth N. Balasubramanian +1Spatial Reasoning BenchmarksVisual Spatial Reasoning

  19. Constructive Distortion: Improving MLLMs with Attention-Guided Image Warping

    Oct 10, 2025Dwip Dalal, Gautam Vashishtha, Utkarsh Mishra +6Object Hallucination in VLMsMultimodal Large Language Models

  20. Mitigating Hallucinations via Inter-Layer Consistency Aggregation in Large Vision-Language Models

    May 18, 2025Kai Tang, Jinhao You, Yichen Guo +8Vision-Language ModelsHallucination in Language Models

  21. SpurLens: Automatic Detection of Spurious Cues in Multimodal LLMs

    Mar 11, 2025Parsa Hosseini, Sumit Nawathe, Mazda Moayeri +2VLM EvaluationVLM Robustness