VLM Interpretability

VLM: Vision-Language Model

Momentum

24 papers in the last four weeks, up 200% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 158

All topics
CardsList
  1. Event-Grounded Sparse Autoencoders for Vision-Language-Action Policies

    May 17, 2026Xinchen Jin, Aditya Chatterjee, Pranav Kumar +1VLM InterpretabilitySparse Autoencoders

  2. Right Predictions, Misleading Explanations: On the Vulnerability of Vision-Language Model Explanations

    May 15, 2026Narges Babadi, Hadis KarimipourVLM RobustnessAdversarial Attacks on VLMs

  3. Sparse Autoencoders enable Robust and Interpretable Fine-tuning of CLIP models

    May 15, 2026Fabian Morelli, Arnas Uselis, Ankit Sonthalia +1Distribution Shift RobustnessVLM Robustness

  4. Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination

    May 15, 2026Chufan Shi, Cheng Yang, Yaokang Wu +4VLM EvaluationVLM Robustness

  5. Your CLIP has 164 dimensions of noise: Exploring the embeddings covariance eigenspectrum of contrastively pretrained vision-language transformers

    May 14, 2026Jakub Grzywaczewski, Dawid Płudowski, Przemysław BiecekRepresentation GeometryRepresentation Learning

  6. Revealing the Gap in Human and VLM Scene Perception through Counterfactual Semantic Saliency

    May 13, 2026Ziqi Wen, Parsa Madinei, Miguel P. EcksteinVLM EvaluationVision-Language Models

  7. Revealing Interpretable Failure Modes of VLMs

    May 12, 2026Isha Chaudhary, Vedaant V Jain, Kavya Sachdeva +2VLM RobustnessVision-Language Models

  8. Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination

    May 11, 2026Yangneng Chen, Junlin Li, Weijun Yao +4Hallucination in Language ModelsVLM Hallucination

  9. Investigating Anisotropy in Visual Grounding under Controlled Counterfactual Perturbations

    May 9, 2026Gabriele Lombardo, Luigi Maiorana, Liliana Lo Presti +1Neural Representation GeometryVLM Interpretability

  10. Uncovering and Shaping the Latent Representation of 3D Scene Topology in Vision-Language Models

    May 8, 2026Haoming Wang, Wei GaoVisual Spatial ReasoningVLM Interpretability

  11. When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models

    May 7, 2026Harshvardhan Saini, Samyak Jha, Yiming Tang +1Vision-Language ModelsObject Hallucination in VLMs

  12. Large Vision-Language Models Get Lost in Attention

    May 7, 2026Gongli Xi, Ye Tian, Mengyu Yang +5Transformer FFNsVision-Language Models

  13. Causal Probing for Internal Visual Representations in Multimodal Large Language Models

    May 7, 2026Zehao Deng, Tianjie Ju, Zheng Wu +5Multimodal Large Language ModelsVLM Interpretability

  14. Joint Semantic Token Selection and Prompt Optimization for Interpretable Prompt Learning

    May 6, 2026Yating Wang, Yaqi Zhao, Yongshun Gong +2Prompt LearningVLM Adaptation

  15. Neuroscience-Inspired Analyses of Visual Interestingness in Multimodal Transformers

    May 5, 2026Mathis Immertreu, Fitim Abdullahu, Thomas Kinfe +3Transformer InterpretabilityVision-Language Models

  16. Embodied Interpretability: Linking Causal Understanding to Generalization in Vision-Language-Action Models

    May 1, 2026Hanxin Zhang, Mingshuo Xu, Abdulqader Dhafer +3VLM RobustnessVLM Interpretability

  17. InterPartAbility: Phrase-Region Grounding for Interpretable Text-to-Image Person Re-Identification

    Apr 29, 2026Shakeeb Murtaza, Aryan Shukla, Rajarshi Bhattacharya +2VLM InterpretabilityVision-Language Grounding

  18. FAIR_XAI: Improving Multimodal Foundation Model Fairness via Explainability for Wellbeing Assessment

    Apr 26, 2026Sophie Chiang, Tom Brennan, Fethiye Irmak Dogan +2Depression DetectionMedical Diagnosis

  19. ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety

    Apr 21, 2026Kun Wang, Cheng Qian, Miao Yu +6LLM Backdoor AttacksMultimodal Large Language Models

  20. Progressive Online Video Understanding with Evidence-Aligned Timing and Transparent Decisions

    Apr 20, 2026Kecheng Zhang, Zongxin Yang, Mingfei Han +6Streaming Video UnderstandingEfficient VLM Inference

  21. From Heads to Neurons: Causal Attribution and Steering in Multi-Task Vision-Language Models

    Apr 20, 2026Qidong Wang, Junjie Hu, Ming JiangMulti-Task LearningCausal Attribution

  22. Real-Time Visual Attribution Streaming in Thinking Model

    Apr 17, 2026Seil Kang, Woojung Han, Junhyeok Kim +3VLM InterpretabilityMultimodal Reasoning

  23. How Do LLMs and VLMs Understand Viewpoint Rotation Without Vision? An Interpretability Study

    Apr 16, 2026Zhen Yang, Ping Jian, Zhongbin Guo +5Visual Spatial ReasoningLarge Vision-Language Models

  24. Reasoning Dynamics and the Limits of Monitoring Modality Reliance in Vision-Language Models

    Apr 16, 2026Danae Sánchez Villegas, Samuel Lewis-Lim, Nikolaos Aletras +1CoT FaithfulnessVision-Language Models

  25. Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs

    Apr 8, 2026Mengdan Zhu, Senhao Cheng, Liang ZhaoVLM InterpretabilityLatent Visual Reasoning

  26. When Sinks Help or Hurt: Unified Framework for Attention Sink in Large Vision-Language Models

    Apr 1, 2026Jiho Choi, Jaemin Kim, Sanghwan Kim +2Large Vision-Language ModelsVLM Interpretability