VLM Interpretability

VLM: Vision-Language Model

Momentum

24 papers in the last four weeks, up 200% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 158

All topics
CardsList
  1. Towards Robustness against Typographic Attack with Training-free Concept Localization

    Jul 2, 2026Bohan Liu, Wenqian Ye, Guangzhi Xiong +3VLM RobustnessAdversarial Attacks on VLMs

  2. Decodable Is Not Grounded: A Vision-Ablation Arbiter for VLM Spatial Reasoning

    Jun 30, 2026Chih-Ting Liao, Fei Shen, Xin Cao +1Visual Spatial ReasoningVLM Interpretability

  3. H-GRPO: Permutation-Invariant Reinforcement Learning for Grounded Visual Reasoning

    Jun 29, 2026Eric Peh, Debaditya Roy, Basura FernandoReinforcement LearningVisual Reasoning

  4. How LLMs See Creativity: Zero-Shot Scoring of Visual Creativity with Interpretable Reasoning

    Jun 29, 2026William Orwig, Roger E. BeatyCreativity AssessmentLLM-as-a-Judge

  5. FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models

    Jun 28, 2026Yichen Guo, Kai Tang, Fenglai Lin +5Vision-Language ModelsLarge Vision-Language Models

  6. Vision-Default, Prior-Override: Causal Mechanisms of Perception-Knowledge Conflict in Vision-Language Models

    Jun 26, 2026Niclas Lietzow, Danielle Bitterman, Carsten Eickhoff +2Knowledge Conflicts in Language ModelsVLM Interpretability

  7. Understanding How MLLMs Describe Artworks Using Token Activation Maps

    Jun 26, 2026Nicola Fanelli, Pasquale De Marinis, Raffaele Scaringi +3VLM InterpretabilityVision-Language Grounding

  8. Bridging Vision and Language Concepts through Optimal Transport Semantic Flow

    Jun 25, 2026Chenyang Zhang, Anqi Dong, Guangming Zhu +4Concept Bottleneck ModelsVLM Interpretability

  9. Steering Vision-Language Models with Joint Sparse Autoencoders

    Jun 24, 2026Huizhen Shu, Xuying Li, Hongxu Lin +2VLM InterpretabilitySparse Autoencoders

  10. UniDrive: A Unified Vision-Language and Grounding Framework for Interpretable Risk Understanding in Autonomous Driving

    Jun 23, 2026Xiaowei Gao, Pengxiang Li, Yitai Cheng +4VLMs for Autonomous DrivingAutonomous Driving Perception

  11. Evaluating the Interpretability of Sparse Autoencoders with Concept Annotations

    Jun 23, 2026Jonas Klotz, Cassio F. Dantas, Pallavi Jain +2VLM InterpretabilitySparse Autoencoders

  12. Ill-Posed by Design: Probing Evidence Use in VLMs

    Jun 23, 2026Boaz Meivar, Shaked Perek, Shani Shvartzman +2VLM EvaluationCounterfactual Evaluation of VLMs

  13. Listening makes Vision Clear for VLMs

    Jun 22, 2026Yiyang Chen, Yixin Tan, Binrui ShenVLM EvaluationVisual Attention

  14. Extraction and Analysis of Multimodal Concepts in Vision Language Models through Sparse Autoencoders

    Jun 19, 2026Sergio Lanza, Jae Hee Lee, Stefan WermterVision-Language ModelsVLM Interpretability

  15. The Hidden Evolution of Disguised Visual Context inside the VLM

    Jun 18, 2026Wish Suharitdamrong, Tony Alex, Muhammad Awais +1Vision-Language ModelsLarge Vision-Language Models

  16. SpatialSV: Internalizing Interpretable 3D Spatial Awareness in MLLMs via Task-Oriented Visual Supervision

    Jun 18, 2026Jiayu Tang, Yuchen Zhou, Chao Gou3D Spatial ReasoningVLM Interpretability

  17. Multimodal Concept Bottleneck Models

    Jun 18, 2026Tongqing Shi, Ge Yan, Tuomas Oikarinen +1Concept Bottleneck ModelsVLM Interpretability

  18. PhaseWin: An Efficient Search Algorithm for Faithful Visual Attribution

    Jun 16, 2026Zihan Gu, Junchi Zhang, Li Liu +2Feature AttributionVLM Interpretability

  19. Attention Alignment Between Humans and Vision-Language Models

    Jun 16, 2026Isaac R. Christian, Udith Haputhanthrige, Hanna Hornfeld +4VLM EvaluationVisual Attention

  20. Visuals Lie, Consistency Speaks: Disentangling Spatial Attention from Reliability in Vision-Language Models

    Jun 16, 2026Logan Mann, Yi Xia, Ajit Saravanan +6VLM EvaluationVLM Robustness

  21. Gen-VCoT: Generative Visual Chain-of-Thought Reasoning via Diffusion-Based RGB Intermediate Representations

    Jun 15, 2026Zhiqiang Zhou, Junliang Dai, Xu lingVLM InterpretabilityMultimodal CoT Reasoning

  22. Gaze Heads: How VLMs Look at What They Describe

    Jun 12, 2026Rohit Gandikota, David BauImage CaptioningVisual Attention

  23. Mirage Probes: How Vision Models Fake Visual Understanding

    Jun 11, 2026Daniel Ben-Levi, Judah Goldfeder, Weiliang Zhao +5Vision-Language ModelsVLM Interpretability

  24. Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension

    Jun 11, 2026Shenglai Zeng, Qirui Wang, Kai Guo +3VLM RobustnessVisual Attention

  25. Disentangling Hallucinations: Orthogonal Semantic Projection for Robust Interpretability

    Jun 8, 2026Emirhan Bilgiç, Baptiste Caramiaux, Zhi Yan +1VLM InterpretabilityMultimodal Model Interpretability

  26. How Many Counterfactuals Does It Take? Probing VLM Hallucinations Through Circuits and Causal Effects

    Jun 7, 2026Abhivansh Gupta, Simardeep Singh, Advika Sinha +2Hallucination Detection in VLMsVLM Robustness