VLM Interpretability

VLM: Vision-Language Model

Momentum

24 papers in the last four weeks, up 200% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 158

All topics
CardsList
  1. FearCaut-Qwen: Affective Steering in a Vision-Language Model Shifts the Decision Criterion for Hazard Assessment

    Oct 8, 2026Xiaoshan ZhouDisaster Damage AssessmentVLM Interpretability

  2. Visual Evidence Under Cross-Examination: Evaluating and Controlling Decision-Level Evidence Use in Vision-Language Models

    Oct 7, 2026Huiyao Zhang, Jin Bai, Zilong Su +6VLM EvaluationFaithfulness in VLMs

  3. CRAFT: Causal Responsibility and Failure Tracing in Medical Vision Language Models

    Sep 30, 2026Chunzheng Zhu, Jiaqi Zeng, Hongbo Zhao +3Vision-Language ModelsMedical VQA

  4. NeuronEye: Query-Guided Visual Concept Activation for Vision-Language Reasoning

    Sep 29, 2026Ruiyu Yan, Bowen Chen, Shaowen Wan +1VLM InterpretabilityVLM Reasoning

  5. CHOQOLATE: Organizing Concept Bottleneck Latent Spaces with Choquet Integrals

    Sep 29, 2026Rémi Kazmierczak, Johanne Cohen, Marianne ClauselConcept Bottleneck ModelsVLM Interpretability

  6. Are In-Context Images Worth 10 Dimensions?

    Sep 29, 2026Adhemar de Senneville, Xavier Bou, Jérémy Anger +2Vision-Language ModelsMultimodal ICL

  7. Targeted Visual Counterfactual Explanations for Contrastive Vision-Language Model

    Sep 29, 2026Van Bach Nguyen, Jörg Schlötterer, Christin SeiferVision-Language ModelsVLM Interpretability

  8. Speed in the Blind Spot: An Interpretability Analysis of Dynamic Perception in VLMs for Autonomous Driving

    Sep 29, 2026Katharina Winter, Stefan Englmeier, Fabian B. FlohrVLMs for Autonomous DrivingVLM Interpretability

  9. How Medical VLMs Underutilize Their Vision Encoders: A Dermatology Perspective

    Sep 29, 2026Janet Wang, Yunbei Zhang, Xiao Wang +1Medical DiagnosisVLM Interpretability

  10. Who Is Left of Whom? Tracing Spatial Evidence and Role Binding in Relative-Position Reasoning

    Sep 28, 2026Yingjin Song, Denis Paperno, Albert GattVisual Spatial ReasoningRelational Reasoning

  11. When Words Speak Louder than Images: Towards Understanding Language Bias in Vision-Language Models

    Sep 28, 2026Yizhou Fang, Siyue Chen, Zimo Qi +3VLM EvaluationVision-Language Models

  12. AnswerMap: Faithful Spatial Interpretability of VLMs from Answer Posteriors

    Sep 28, 2026Mohamed Eltahir, Fardows Adam, Duaa M. Tahir +6Vision-Language ModelsVLM Interpretability

  13. From Perception to Integration: Revisiting the Internal Dynamics of Reasoning in Vision-Language Models

    Sep 28, 2026Rong Yu Xu, Prayag Tiwari, Shaolei ZhangEfficient VLM InferenceVLM Interpretability

  14. Do Emotion Concepts Generalize Across Sources, Modalities, and Architectures in Vision-Language Models?

    Sep 28, 2026Bohao Xing, Xin Liu, Kaishen Yuan +5Cross-Modal LearningVision-Language Models

  15. The Alignment Illusion in Multimodal Large Language Models

    Sep 24, 2026Hong-Han Wang, Yuntao Wang, Hu DingRepresentational Similarity AnalysisMultimodal Large Language Models

  16. Where Hallucinations Live: A Cross-Architecture Circuit in VQ-Tokenized Vision-Language Models

    Sep 24, 2026Shamanthak Hegde, Xiangrui Liu, Maitreya Patel +1Vision-Language ModelsObject Hallucination in VLMs

  17. What do VLM-Based Vision-Language Navigation Models Rely on: Interpreting and Steering Policy Behavior

    Sep 21, 2026Débora Oliveira Makowski, Samiran Gode, Abhijeet Nayak +4Vision-Language ModelsVLM Interpretability

  18. Decodable but Misrouted: Sparse Features Uncover a Readout Gap in Vision-Language Models for Harmful Meme Detection

    Sep 16, 2026Girish A. Koushik, Diptesh Kanojia, Helen TreharneVLM EvaluationVLM Robustness

  19. Using OCR Heads to Verbalize Image Semantics

    Sep 16, 2026Sheridan Feucht, Benno Krojer, Sarah Wang +3VLM InterpretabilityMechanistic Interpretability

  20. EDCT-Bench: Uncovering Faithfulness Gaps in VLMs via Explanation-Driven Counterfactual Testing

    Sep 16, 2026Sihao Ding, Santosh Vasa, Aditi Ramadwar +1VLM EvaluationVLM Robustness

  21. ResLRP: The Role of Residual Cancellation in Attribution Instability in Vision Transformers

    Sep 15, 2026Jim Berend, Reduan Achtibat, Daniel Schäffer +4Transformer InterpretabilityResidual Learning

  22. ProtoLIP: From Sentence-Level to Object-Level Evidence Disentanglement

    Sep 14, 2026Yan Zhu, Yongbo Chen, Zhengming Ding +1Vision-Language ModelsPrototype Learning

  23. Pixel Decodability Is Not a Compression Signal: Causally Evaluating Importance Proxies for Visual KV-Cache Eviction

    Sep 14, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1KV CachingKV-Cache Eviction

  24. Canonical Color as a Lens into Concept Decodability in Vision Encoders and VLMs

    Sep 8, 2026Xiaofu Chen, Stella Frank, Yova KementchedjhievaVLM Interpretability

  25. Who Drives the Probability Game of VLMs? A Temporal Causal Drive Evaluation Framework

    Sep 2, 2026Shuyao Xiao, Shengling Wang, Haoyu Niu +4VLM EvaluationVLM Interpretability

  26. Visual Attention Faithfulness in Vision-Language Models is Heterogeneous

    Sep 1, 2026Xurui Song, Weishi Wang, Zhongqi Yue +5VLM EvaluationVisual Question Answering

  27. Do VLMs Share Safety Neurons Across Modalities?

    Aug 31, 2026Jiaxuan Li, Jiahao Zhang, Duc Minh Vo +3VLM EvaluationVLM Interpretability