Medical VLMs

VLM: Vision-Language Model

Momentum

22 papers in the last four weeks, up 22% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 266

All topics
CardsList
  1. Towards Enhancing 3D Spatial Reasoning in Medical Multimodal Large Language Models

    Jul 15, 2026Zhuoyuan Fu, Zeshang Li, Yiqiong Zhang +53D Spatial Reasoning3D Medical Imaging

  2. LaGuadia: Language-Guided Adaptive Distillation from Pathology Foundation Models

    Jul 13, 2026Gangsu Kim, Won-Ki JeongComputational PathologyPathology Foundation Models

  3. The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy

    Jul 13, 2026Chunzheng Zhu, Lei Tian, Bohan Tan +15HealthcareLLM Agent Self-Improvement

  4. Learning Anatomy-Grounded CT Vision-Language Representations with Organ-Hierarchical Report Knowledge

    Jul 12, 2026Guoliang You, Hongming Li, Yuanwang Zhang +1Radiology VLMsMedical VLMs

  5. TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models

    Jul 10, 2026Tianyou Jiang, Ziyu ZhouFew-Shot Domain AdaptationVLM Adaptation

  6. Super-Generalist: Towards Comprehensive and Accurate Medical Image Understanding via Generalist-Specialist Synergy

    Jul 10, 2026Shaoteng Zhang, Weiwei Cao, Wanxing Chang +9Medical Image ClassificationMedical VLMs

  7. OmniFood-Bench: Evaluating VLMs for Nutrient Reasoning and Personalized Health Advice

    Jul 9, 2026Qian Jiang, Zhecheng Shi, Jingpu Yang +2VLM EvaluationMedical VLMs

  8. MedPMC: A Systematic Framework for Scaling High-Fidelity Medical Multimodal Data for Foundation Models

    Jul 8, 2026Hyunjae Kim, Dain Kim, Pan Xiao +25Medical Imaging Foundation ModelsTraining Data Curation

  9. Seeing What Matters: Lesion-Aware High-Resolution Patch Discovery and Fusion for Chest X-ray Report Generation

    Jul 8, 2026Yingshu Li, Yunyi Liu, Zhenghao Chen +5Radiology Report GenerationMedical Image Analysis

  10. Cross-Contextual Vision-Language Adaptation with LoRA for Personalized Severe Adverse Event Detection in Clinical Wound Monitoring

    Jul 6, 2026Aditi Naiknaware, Jian Sun, Aminreza Khandan +4VLM AdaptationLow-Rank Adaptation

  11. Evaluating and Understanding Model Editing for Medical Vision Language Models

    Jul 6, 2026Guli Zhu, Chenwei Wu, Liyue ShenKnowledge EditingMedical VLMs

  12. IRIS: An Intelligent Vision-Language System for Ocular Surface Diseases via Topic Tree and Scene-Driven VQA Generation

    Jul 5, 2026Hao Wei, Wenjin Qi, Dasen Dai +2Visual Question AnsweringVision-Language Models

  13. CogRad: A Cognitively-Inspired Multi-Agent Framework for Radiology Report Generation

    Jul 4, 2026Saif Ur Rehman Khan, Hasaan Maqsood, Sebastian Vollmer +2Radiology Report GenerationMedical VLMs

  14. Do Medical Vision Language Models Actually See? A Counterfactual Grounding Framework and Hard-Negative Contrastive Training for Visually-Reliant Medical VLMs

    Jul 4, 2026Anas Zafar, Leema Krishna Murali, Siddhant Bharadwaj +2VLM EvaluationCounterfactual Evaluation

  15. Towards Real-World Ultrasound Understanding: Large Vision-Language Models from Multi-Image Examinations with Long-Form Reports

    Jul 2, 2026Bingcong Yan, Chunlei Li, Jingliang Hu +3VLM AdaptationUltrasound Imaging

  16. MMIR-TCM: Memory-Integrated Multimodal Inference and Retrieval for TCM Clinical Decision Support

    Jul 2, 2026Lihui Luo, Joongwon Chae, Ziyan Chen +13Multimodal RAGMedical Diagnosis

  17. Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning

    Jun 30, 2026Junha Jung, Minbyul Jeong, Suhyeon Lim +5Process Reward ModelsMedical VQA

  18. Evo-PI: Aligning Medical Reasoning via Evolving Principle-Guided Supervision

    Jun 30, 2026Xianda Zheng, Huan Gao, Meng-Fen Chiang +3LLM AlignmentMedical VLMs

  19. Token-Sparse Medical Multimodal Reasoning via Dual-Stream Reinforcement Learning

    Jun 30, 2026Kaitao Chen, Weiqian Zhao, Jiamin Wu +6Efficient Multimodal InferenceMedical VQA

  20. Synergistic Perception-Reasoning Governance: Grounding Medical MLLMs with Verifiable Anatomical Evidence

    Jun 30, 2026Rui Hao, Qiankun Li, Junyuan Mao +4Radiology Report GenerationMedical VQA

  21. HyperVLP: Enhancing Hierarchical Surgical Video-Language Pre-training in Hyperbolic Space

    Jun 30, 2026Yaojun Hu, Kun Yuan, Nassir Navab +3Hierarchical Representation LearningSurgical Video Understanding

  22. Latent-CURE for Breast Cancer Diagnosis

    Jun 29, 2026Weiyi Zhao, Xiaoyu Tan, Lu Gan +2Breast CancerLong-Tail Learning

  23. SonoCLIP: Mask-Guided Region-Aware Vision-Language Pretraining for Fetal Ultrasound Analysis

    Jun 28, 2026Hang Su, Chao Sun, Zhaofan Li +3Medical Imaging Foundation ModelsUltrasound Imaging

  24. Detecting Clinical Hallucinations in LVLMs via Counterfactual Visual Grounding Uncertainty

    Jun 26, 2026Xiao Song, Haonan Qin, Zhaoxu Zhang +3Hallucination Detection in VLMsVLM Hallucination

  25. EchoSonar-R: A Multi-View Reasoning-Enabled Model for Disease Classification and Report Generation in Echocardiography

    Jun 26, 2026Darya Taratynova, Ahmed Aly, Numan Saeed +1Medical Report GenerationEchocardiography

  26. Aloe-Vision: Robust Vision-Language Models for Healthcare

    Jun 25, 2026Jaume Guasch-Martí, Enrique Lopez-Cuena, Martín Suárez-Fernández +3VLM EvaluationVLM Robustness

  27. CORTEX: A Structured Reasoning Benchmark for Trustworthy 3D Chest CT MLLMs

    Jun 25, 2026Hashmat Shadab Malik, Anees Ur Rehman Hashmi, Numan Saeed +3Radiology Report Generation3D Medical Imaging

  28. Just how sure are you? Improving Verbalized Uncertainty Calibration in Medical VQA

    Jun 25, 2026Eren Senoglu, Federico Toschi, Nicolo Brunello +2Medical VQALanguage Model Calibration

  29. TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation

    Jun 25, 2026Zhixiang Lu, Xiwei Liu, Sifan Song +5Radiology Report GenerationMedical VLMs