Multimodal Model Interpretability

Latest papers 70

All topics
CardsList
  1. Multimodal Safety Evaluation Should Measure Controllability Beyond Classification

    Oct 5, 2026Junhyeong Park, Hanwool Lee, DongGeon Lee +4Multimodal Model InterpretabilityMultimodal Model Evaluation

  2. Seeing What Should Be Heard: Diagnosing and Repairing Cross-Modal Shortcuts in Omni-Modal LLMs

    Sep 29, 2026Yueran Ma, Ronghao LinAudio QAMultimodal Large Language Models

  3. T-MoXAI: A Hierarchical Explainability Framework for Temporal Multimodal Data

    Sep 27, 2026Ali Inha, Mo Vali, Saaliha Vali +2Explainable Time Series ForecastingMultimodal Model Interpretability

  4. FCA-Guided Counterfactual Explanations for Multi-Modal Breast Cancer Diagnosis: A Framework Achieving Perfect Validity with Emergent Sparsity

    Sep 17, 2026Abdullahi Isa, Souley Boukari, Muhammad AliyuBreast CancerCounterfactual Explanations

  5. IMPACT-VLA: Interaction-aware Multimodal Propagation Attribution via Counterfactual Trajectories for Vision-Language-Action Policies

    Sep 14, 2026Jinwoong Kim, Sangjin ParkRobotic ManipulationVision-Language-Action Models

  6. LatentVerse: A Framework for Understanding Shared and Modality-Specific Information in Multimodal Latent Representations

    Sep 14, 2026Majd Alafrange, Samuel Friedman, John Kitonyo +2Multimodal EmbeddingMultimodal Model Interpretability

  7. A Multimodal Explainable Deep Learning Framework for Alzheimer's Disease Diagnosis using 3D Magnetic Resonance Imaging and Clinical Data

    Sep 14, 2026Yusuf Brima, Marcellin Atemkeng, Lakshmana Rao Namamula +13D Medical ImagingMultimodal Classification

  8. Toward Interpretable Multimodal Fusion: Heat Conduction Modeling for Hyperspectral and LiDAR Joint Classification

    Sep 12, 2026Kan Wei, Jiahui Cui, Jing Yao +3Multimodal Model InterpretabilityHyperspectral Image Classification

  9. The Platonic brain bridge hypothesis: human brain networks as an architectural prior for multimodal large language models

    Sep 10, 2026Pengfei Zhang, Biao Tian, Xiangang Li +1Neural DecodingMultimodal Foundation Models

  10. Towards reliable multimodal disaster severity assessment through preference optimization and explainable vision-language reasoning

    Sep 1, 2026Yuanjun Zhang, Fuzel Ahamed Shaik, Suvojit Acharjee +2Disaster Damage AssessmentMultimodal Classification

  11. TAMI: Temporally Aligned, Missingness-Aware, and Interpretable Multimodal Fusion for Mental Health Assessment in Older Adults with Mild Cognitive Impairment

    Aug 31, 2026Merna Bibars, Bolaji Omofojoye, Allan I. Levey +3Missing-Modality LearningDepression Detection

  12. Multimodal Model Diffing for Feature Discovery and Control

    Aug 10, 2026Hunar Batra, Lachin Naghashyar, Ashkan Khakzar +4Sparse AutoencodersMultimodal Model Interpretability

  13. Simile Understanding in Text-to-Image Models: An Evaluation Framework

    Aug 5, 2026Luecheng Wang, Shintaro Ozaki, Hidetaka Kamigaito +4Figurative Language UnderstandingVision-Language Grounding

  14. Persistent Convolution: A Topological Framework for AI Alignment Testing and Semantic Space Characterization

    Jul 31, 2026Tyler Ashoff, Jordan RoduAI AlignmentCross-Modal Alignment

  15. Witness Evidence Portfolios: Single-Prefill Risk Detection for Closed Multimodal Answers

    Jul 30, 2026Fexiang Liu, Shiye Wang, Qiang Qiu +1VLM EvaluationMultimodal Large Language Models

  16. Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs

    Jul 29, 2026Vahidin Hasic, Chao Wang, Luis C. Garcia-Peraza-Herrera +2Multimodal Large Language ModelsMultimodal Model Interpretability

  17. Do Unified Multimodal Models Think in One Space? A Lens Through Cross-Branch Steering

    Jul 29, 2026Yu Wang, Sharon LiUnified Multimodal ModelsCross-Modal Alignment

  18. Seeing or Knowing? Visual Context Sensitivity in Multimodal Large Language Models

    Jul 28, 2026Jiaang Li, Chengzu Li, Zhaochong An +4VLM EvaluationMultimodal Large Language Models

  19. CARA: Concept-Aware Risk Attention for Interpretable Collision Anticipation

    Jul 24, 2026Zhishan Tao, Ruoyu Wang, Yucheng Wu +6Autonomous DrivingTraffic Accident Anticipation

  20. M3^3-Gen: Interpretable Multimodal Generation of Gene Expression Profiles Using Clinical and Imaging Data

    Jul 23, 2026Francesca Pia Panaccione, Carlo Sgaravatti, Marco VenereMultimodal GenerationMultimodal Model Interpretability

  21. HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models

    Jul 23, 2026Weilin Jin, Mingyu Wang, Wenbo Li +5Hallucination Detection in VLMsMultimodal Hallucination

  22. MultiLoReFT: Decoupling Shared and Modality-Specific Subspaces in Multimodal Learning via Low-Rank Representation Fine-Tuning

    Jul 18, 2026Sana Tonekaboni, Viktoria Schuster, Caroline UhlerCross-Modal Representation LearningMultimodal Disentangled Representation Learning

  23. DELUGE: Towards Continental-Scale Daily Pluvial Flood Damage Prediction via Interpretable Conditioning on Foundation Model Embeddings

    Jul 17, 2026Yuya Kawakami, Daniel Cayan, Dongyu Liu +2Disaster Damage AssessmentMultimodal Model Interpretability

  24. The Hyperspherical Geometry of CLIP Latent Space: A Semantic Mixture Model

    Jul 15, 2026Zijie Yu, Gaowen Liu, Ramana Rao Kompella +2Latent Variable ModelsHyperspherical Representation Learning

  25. Multimodal Routing for Interpretable, Robust, and Auditable Clinical Prediction

    Jul 10, 2026Nikkie Hooman, Zhongjie Wu, Eric C. Larson +1Multimodal RobustnessClinical Prediction

  26. When Structured Sparse Autoencoders Learn Consistent Concepts Across Modalities

    Jul 9, 2026Weiduo Liao, Yunqiao Yang, Ying WeiVLM InterpretabilitySparse Autoencoders