Medical VLMs

VLM: Vision-Language Model

Momentum

22 papers in the last four weeks, up 22% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 266

All topics
CardsList
  1. ReMoE: Report-Guided Mixture-of-Experts for Multimodal OCT/OCTA Anomaly Detection

    Jul 31, 2026Zihan Nie, Qincheng Qiao, Muhao Xu +4Mixture of ExpertsOptical Coherence Tomography

  2. A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports

    Jul 30, 2026Jia Yu, Yan Zhu, Yili He +12EndoscopyMedical VLMs

  3. Mitigating Class-Tail Undercoverage in Medical Vision-Language Models under Clinical Shift

    Jul 30, 2026Mushir Akhtar, M. TanveerGroup-Conditional Conformal PredictionConformal Prediction

  4. LoMeVQA: A Comprehensive Benchmark for Longitudinal Medical VQA

    Jul 30, 2026Zhilin Wu, Zhangkai Ni, Chengmei Yang +4Longitudinal Medical Image AnalysisMedical VQA

  5. PanDent: Toward Comprehensive Tooth-Level Structure-Language Consistency in Dental Radiology

    Jul 29, 2026Xiaohan Li, Xinyu Liu, Chang Liu +4Radiology Report GenerationMedical Imaging

  6. Position, Not Provenance: Separating Reasoning Mediation from Sycophancy in Medical Vision-Language Models

    Jul 29, 2026Supratik Bhowal, Subhrajyoti Basu, Aritra Gir Mahanta +1Medical VQAMedical VLMs

  7. Towards Grounded GI Endoscopy VQA via Multi-Task Learning on Small VLMs

    Jul 29, 2026Itbaan Safwan, Ramail Khan, Muhammad Annas Shaikh +1EndoscopyMedical VQA

  8. Hearsay: Vision-Language Medical Diagnoses Without an Image

    Jul 29, 2026Siddharth VohraVLM EvaluationMedical Image Analysis

  9. SCALPEL: Semantic Cross-modal Alignment via LLM-Powered Encoder Learning for Medical Vision-Language Representation

    Jul 29, 2026Yunzhan Fu, Enyu Bao, Xiangyu Shen +4Radiology VLMsMedical VLMs

  10. MedARC: Training-Free Adaptive Redundancy Compression of Visual Tokens for 3D Medical Vision-Language Models

    Jul 29, 2026Yitao Zhu, Mengjun Liu, Yingji Fu +2Efficient VLM InferenceMedical VLMs

  11. Rethinking Clinical Relevance in Chest X-ray Machine Learning: How Evaluation References Define Performance

    Jul 28, 2026Panagiotis Fytas, Ian Selby, Clemens Karner +14Chest X-Ray ClassificationMedical VLMs

  12. Evaluating Multi-Turn Multimodal Diagnostic Reasoning on Challenging Real-World Clinical Cases

    Jul 28, 2026Rui Yang, Weihao Xuan, Yi Lin +23Medical VLMsMulti-Turn Dialogue Evaluation

  13. Towards Reliable Stain Transfer: An Iterative Data-Model Co-Optimization Framework Based on Multimodal Expert-Guided Assessment

    Jul 28, 2026Siyuan Xu, Yan Wang, Haofei Song +7Computational PathologyImage Style Transfer

  14. ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding

    Jul 27, 2026Hangjie Yuan, Yichen Qian, Zhiwei Tang +21Medical Report GenerationMedical VQA

  15. PathSelect: Sequential Token Selection for Whole Slide Pathology

    Jul 26, 2026Jingzhi Chen, Landi He, Zehong Chen +2Efficient VLM InferenceMedical VLMs

  16. Explaining BiomedCLIP with Weighted Banzhaf Interactions Supported by Tree-Gram Parsing

    Jul 25, 2026Jakub Rymarski, Adam Rempała, Bartłomiej Sobieski +1VLM InterpretabilityShapley Value Attribution

  17. TextSLIP: Text Self-Supervised CLIP for Medical Report Generation

    Jul 24, 2026Haoyu Jiang, Ziping CongRadiology Report GenerationSelf-Supervised Learning

  18. Cheap Probes Predict Expensive Training in 3D-CT Vision--Language Models

    Jul 24, 2026Renjie LiangVLM EvaluationMedical VLMs

  19. Do Pathology Vision-Language Models Truly See Pathology?

    Jul 23, 2026Chengyang Zhang, Wenchuan Zhang, Bo Li +10VLM EvaluationComputational Pathology

  20. Sparse Concept Channels in Frozen 3D CT Vision Encoders

    Jul 23, 2026Farhad Nooralahzadeh, Lea Bogensperger, Christian Bluethgen +1Radiology Report Generation3D Medical Imaging

  21. Latent-Action-Guided Video-Language Feature Learning for Surgical Instrument-Tissue Interaction Recognition

    Jul 22, 2026Jiajun Cheng, Sainan Liu, Subarna Tripathi +2Latent Action LearningSurgical Video Understanding

  22. PathAgentBench: Benchmarking Evidence-Seeking Vision-Language Models on Whole-Slide Pathology Image

    Jul 21, 2026Dankai Liao, Tianyi Zhang, Yufeng Wu +6VLM EvaluationMedical VLMs

  23. Attention Without Grounding: Causal Evaluation of Visual Explanations in Medical VLMs

    Jul 20, 2026Binesh Sadanandan, Vahid BehzadanVLM EvaluationVLM Interpretability

  24. Can Experts Adapt Without Training? On Test-Time Modality Generalization in MVLMs

    Jul 18, 2026Raza Imam, Darakshan Rashid, Yutong Xie +3VLM RobustnessVLM Adaptation

  25. Model Merging for Medical LVLMs: A Benchmark and a Winner-Take-All Approach

    Jul 17, 2026Lichao Mou, Shilan Zhang, Chunlei Li +7Low-Rank AdaptationMedical VLMs