VLM Interpretability

VLM: Vision-Language Model

Momentum

24 papers in the last four weeks, up 200% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 158

All topics
CardsList
  1. Mechanistic Insights into Functional Sparsity in Multimodal LLMs via CoRe Heads

    Jun 4, 2026Ruoxi Sun, Quantong Qiu, Juntao Li +3Multimodal Large Language ModelsVLM Interpretability

  2. Visual Instruction Tuning Aligns Modalities through Abstraction

    Jun 2, 2026Luis Palacios, Lorenzo Basile, Diego Doimo +1VLM AdaptationVLM Interpretability

  3. Decomposing how prompting steers behavior

    Jun 2, 2026Fan L. Cheng, Nikolaus KriegeskorteLLM PromptingLLM Interpretability

  4. Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification

    Jun 1, 2026Sunisth Kumar, Xanh Ho, Tim Schopf +3VLM InterpretabilityChart Understanding

  5. Self-Improving Small Object Grounding in LVLMs

    Jun 1, 2026Tianze Yang, Yucheng Shi, Ruitong Sun +2Large Vision-Language ModelsVLM Interpretability

  6. Beyond Visual Memory: Mechanistic Diagnostics of Latent Visual Reasoning

    May 31, 2026Garvin Guo, Yu Chen, Xiang Wang +4VLM EvaluationVLM Interpretability

  7. Through the PRISM: Principle-Aware, Interpretable, and Multi-Scale Evaluation of Visual Designs

    May 30, 2026Mona Gandhi, KJ Joseph, Srinivasan Parthasarathy +1VLM EvaluationVLM Interpretability

  8. Vision-Language Models Suppress Female Representations Under Ambiguous Input

    May 29, 2026Arnau Marin-Llobet, Simon Henniger, Mahzarin R. BanajiVLM EvaluationVLM Interpretability

  9. The Regularizing Power of Language-Training Deepfake Detectors

    May 29, 2026Benedikt Hopf, Zongwei Wu, Radu TimofteVLM RobustnessExplainable Deepfake Detection

  10. Why Far Looks Up: Probing Spatial Representation in Vision-Language Models

    May 28, 2026Cheolhong Min, Jaeyun Jung, Daeun Lee +5VLM EvaluationSpatial Reasoning Benchmarks

  11. VITAL: Visual-Semantic Dual Supervision for Enhanced and Interpretable Latent Reasoning in Medical MLLMs

    May 27, 2026Qiaoru Li, Shaotian Liang, Jintao Chen +4Medical VQAVLM Interpretability

  12. Explaining is Harder Than Predicting Alone: Evaluating Concept-based Explanations of MLLMs as ICL Visual Classifiers

    May 27, 2026Carmen Quiles-Ramírez, Leticia L. Rodríguez, Nicolás Martorell +1VLM EvaluationMultimodal Large Language Models

  13. Real Images, Worse Judgments: Evaluating Vision-Language Models on Concreteness and Imagery

    May 26, 2026Yifan Jiang, Ruoxi Ning, Sheng Yao +1VLM EvaluationVision-Language Models

  14. Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models

    May 26, 2026Aaron Branson Cigres Li, Zhaowei Wang, Yu Zhao +9Vision-Language ModelsVLM Interpretability

  15. Binding Visual Features Point by Point

    May 25, 2026Udith Haputhanthri, Declan Campbell, Rim Assouel +2Vision-Language ModelsVLM Interpretability

  16. Seeing without Looking: Do Vision-Language Benchmarks Really Test Vision?

    May 21, 2026Zixuan Lan, Luzhe Sun, Matthew R. Walter +1VLM EvaluationVLM Interpretability

  17. Transcoders Trace Visual Grounding and Hallucinations in Vision-Language Models

    May 21, 2026Dimitrios Damianos, Leon Voukoutis, Georgios Skyrianos +2Object Hallucination in VLMsVLM Interpretability

  18. Conceptualizing Embeddings: Sparse Disentanglement for Vision-Language Models

    May 21, 2026Piotr Kubaty, Patryk Marszałek, Łukasz Struski +3Disentangled Representation LearningMultimodal Disentangled Representation Learning

  19. SegCompass: Exploring Interpretable Alignment with Sparse Autoencoders for Enhanced Reasoning Segmentation

    May 21, 2026Zhenyu Lu, Liupeng Li, Jinpeng Wang +4Image SegmentationText-Guided Image Segmentation

  20. Measuring Cross-Modal Synergy: A Benchmark for VLM Explainability

    May 21, 2026Joël Roman Ky, Salah Ghamizi, Maxime CordyVLM InterpretabilityShapley Value Attribution

  21. Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow

    May 21, 2026Chengsheng Zhang, Chenghao Sun, Zhining Xie +1VLM HallucinationVLM Interpretability

  22. Ablate-to-Validate: Are Vision-Language Models Really Using Continuous Thought Tokens?

    May 20, 2026Tianyi Zhang, Mahtab Bigverdi, Ranjay KrishnaVLM EvaluationVLM Interpretability

  23. Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models

    May 19, 2026Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2Medical VQAVLM Interpretability

  24. Mechanisms of Object Localization in Vision-Language Models

    May 19, 2026Timothy Schaumlöffel, Martina G. Vilas, Gemma RoigVision-Language ModelsVLM Interpretability

  25. Causal Evidence for Attention Head Imbalance in Modality Conflict Hallucination

    May 19, 2026Jinrui Jiang, Zhangtai Wu, Zhen Wu +1Hallucination in Language ModelsMultimodal Large Language Models

  26. Employing Vision-Language Models for Face Image Quality Assessment

    May 17, 2026Erdi Sarıtaş, Eren Onaran, Vitomir Štruc +1VLM EvaluationVLM Robustness