Faithfulness in VLMs

VLM: Vision-Language Model

Latest papers 30

All topics
CardsList
  1. Visual Evidence Under Cross-Examination: Evaluating and Controlling Decision-Level Evidence Use in Vision-Language Models

    Oct 7, 2026Huiyao Zhang, Jin Bai, Zilong Su +6VLM EvaluationFaithfulness in VLMs

  2. SpatialChain: A Benchmark for Auditing Spatial Reasoning Faithfulness in VLMs

    Oct 5, 2026Rafael Teixeira Sousa, Vinícius Paulo Lopes de Oliveira, Elisa Ayumi Masasi de Oliveira +5VLM EvaluationSpatial Reasoning Benchmarks

  3. Beyond Saying Less: Fine-Grained Alignment for Informative and Faithful Vision-Language Models

    Sep 28, 2026Xingming Long, Jie Zhang, Yuecong Min +2Credit Assignment in RLStep-Level Credit Assignment in RL

  4. When VLMs Trust Context: Evaluating Scene Text Recognition under Misleading Context

    Sep 28, 2026Yuxing Cheng, Yuan Wu, Yi ChangVLM EvaluationCounterfactual Evaluation of VLMs

  5. EDCT-Bench: Uncovering Faithfulness Gaps in VLMs via Explanation-Driven Counterfactual Testing

    Sep 16, 2026Sihao Ding, Santosh Vasa, Aditi Ramadwar +1VLM EvaluationVLM Robustness

  6. Does Playing it Safe Count as Faithfulness? Reassessing LVLM Hallucination Mitigation Methods

    Sep 1, 2026Mehrdad Fazli, Sina Mansouri, Mohit Marvania +1VLM EvaluationFaithfulness in VLMs

  7. Visual Attention Faithfulness in Vision-Language Models is Heterogeneous

    Sep 1, 2026Xurui Song, Weishi Wang, Zhongqi Yue +5VLM EvaluationVisual Question Answering

  8. Messages, Not Tokens: Grounded Coresets for Faithful VLM Compression

    Aug 3, 2026Long Qian, Jiaqi Wei, Bingke Zhu +2Efficient VLM InferenceCoreset Selection

  9. DiffuseAgent-MI: Distributionally-Grounded,Tool-Integrated Self-Evolving Agents for Faithful Visual Reasoning

    Aug 1, 2026An Lanji, Dawei Liu, Jin Li +3AI Agent ReliabilityVLM Interpretability

  10. Role-Break in Attention Heads: Understanding and Detecting Hallucinations in VLMs

    Jul 31, 2026Mingyu Wang, Weilin Jin, Wenbo Li +5Hallucination Detection in VLMsAttention Head Analysis

  11. FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Self-Verification

    Jul 30, 2026Haoqing Wang, Xingrun Xing, Ziheng Li +2Tool Use in VLMsVLM Reasoning

  12. Position, Not Provenance: Separating Reasoning Mediation from Sycophancy in Medical Vision-Language Models

    Jul 29, 2026Supratik Bhowal, Subhrajyoti Basu, Aritra Gir Mahanta +1Medical VQAMedical VLMs

  13. FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models

    Jun 28, 2026Yichen Guo, Kai Tang, Fenglai Lin +5Vision-Language ModelsLarge Vision-Language Models

  14. Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding

    Jun 25, 2026Liu Yu, Can Chen, Ping Kuang +3Object Hallucination in VLMsFaithfulness in VLMs

  15. CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework

    Jun 16, 2026Sneha Rao, Shaina Raza, Dhanesh RamachandramVLM EvaluationVision-Language Grounding

  16. Mirage Probes: How Vision Models Fake Visual Understanding

    Jun 11, 2026Daniel Ben-Levi, Judah Goldfeder, Weiliang Zhao +5Vision-Language ModelsVLM Interpretability

  17. YARD: Y-Architecture Register Decoding for Efficient Hallucination Mitigation in Large Vision-Language Models

    May 29, 2026Ting Chen, Geng Li, Guohao Chen +5Efficient VLM InferenceObject Hallucination in VLMs

  18. The Abstraction Gap in Vision-Language Causal Reasoning

    May 27, 2026Chinh Hoang, Mohammad Rashedul HasanVLM EvaluationCausal Reasoning in Language Models

  19. Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention

    May 21, 2026Changyuan Tian, Zhicong Lu, Huaxing Liu +7Multimodal Large Language ModelsMultimodal Reasoning

  20. Ablate-to-Validate: Are Vision-Language Models Really Using Continuous Thought Tokens?

    May 20, 2026Tianyi Zhang, Mahtab Bigverdi, Ranjay KrishnaVLM EvaluationVLM Interpretability

  21. Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating

    May 20, 2026Zhe Cheng, Wenyu Chen, Fode Zhang +1VLM RobustnessHallucination in Language Models

  22. When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models

    May 7, 2026Harshvardhan Saini, Samyak Jha, Yiming Tang +1Vision-Language ModelsObject Hallucination in VLMs

  23. Instruction-Evidence Contrastive Dual-Stream Decoding for Grounded Vision-Language Reasoning

    Apr 28, 2026Yashwant Pravinrao Bangde, Debaditya RoyObject Hallucination in VLMsVision-Language Grounding

  24. Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation

    Apr 27, 2026Yubo Jiang, Xin Yang, Abudukelimu Wuerkaixi +7Hallucination in Language ModelsObject Hallucination in VLMs

  25. Breaking the Illusion: When Positive Meets Negative in Multimodal Decoding

    Apr 22, 2026Yubo Jiang, Yitong An, Xin Yang +7Vision-Language ModelsHallucination in Language Models

  26. TAR: Temporal Anchor-Constrained Reasoning for Video Temporal Grounding

    Aug 11, 2025Chaohong Guo, Xun Mo, Yongwei Nie +3Temporal Video GroundingVision-Language Models