Medical VLMs

VLM: Vision-Language Model

Momentum

22 papers in the last four weeks, up 22% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 266

All topics
CardsList
  1. SurgAtlas: A Large-Scale Surgical Video-Language Dataset with 2,391 Hours of Open and Minimally Invasive Surgery

    Jun 24, 2026Filippos Bellos, Andre S. Gala-Garza, Miaowei Wang +8Medical VQASurgical Video Understanding

  2. Disease-Centric Vision-Language Pretraining with Hybrid Visual Encoding for 3D Computed Tomography

    Jun 24, 2026Bowen Shi, Weiwei Cao, Ruifeng Yuan +5Contrastive Learning3D Medical Imaging

  3. Text Over Image: Auditing Multimodal Robustness in Synthetic Medical Image Detection

    Jun 24, 2026Ching-Hao Chiu, Hao-Wei Chung, Gelei Xu +7Multimodal RobustnessMedical VLMs

  4. Multilingual Hematology Visual Question Answering Dataset

    Jun 24, 2026Hajra Malik, Hafiza Tooba Aftab, Abdul Rehman +2Medical VQAMedical VLMs

  5. BioMedVR: Confusion-Aware Mixture-of-Prompt Experts for Biomedical Visual Reprogramming

    Jun 23, 2026Jiaxiang Liu, Tianxiang Hu, Juwei Guan +5VLM AdaptationMedical VLMs

  6. MedBench v5: A Dynamic, Process-Oriented, and Hallucination-Aware Benchmark for Clinical Multimodal Models

    Jun 23, 2026Jinru Ding, Chuchu Jiang, Lu Lu +12AI Agent BenchmarksMedical VLMs

  7. Brain-Adapter: A Dual-Stream Vision-Language MIL Framework for Comprehensive 3D CT Diagnosis of Acute Intracranial Pathologies

    Jun 22, 2026Zhenyu Yi, Zhiyun Song, Yusong Sun +6VLM Adaptation3D Medical Imaging

  8. CADRE: Stable, Parameter Efficient Adaptation of Medical Vision Language Models with Bounded Forgetting and Prior Drift

    Jun 22, 2026Amrita Singh, Rishabh JhaVLM AdaptationElastic Weight Consolidation

  9. Efficient Multimodal Clinical Question Answering for Pulmonary Embolism Risk Assessment

    Jun 21, 2026Xiangyuan Xue, Yang Yu, Yan Gao +5Efficient Multimodal InferenceMultimodal QA

  10. SAGE: An Expert-Annotated South Asian GI Endoscopy Dataset for Multimodal Learning and Hallucination Analysis

    Jun 20, 2026Niyoj Oli, Sachin Acharya, Sandesh Pokhrel +7EndoscopyMedical Imaging

  11. GTA-Net: Cooperative Game Theory for Vision-Language Alignment in Chest X-Ray Report Generation

    Jun 20, 2026Saif ur Rehman Khan, Imad Ahmed Waqar, Sebastian Vollmer +2Radiology Report GenerationMedical VLMs

  12. MEDLAYXPLAIN: Benchmarking the Expert-Lay Gap in Medical Vision-Language Models

    Jun 19, 2026Han Jang, Junhyeok Lee, Songsoo Kim +4VLM EvaluationMedical VLMs

  13. PROTON: Prototype-Based Test-Time Online OOD Detection for Medical VLMs

    Jun 18, 2026Abhijit Das, Nichula Wasalathilaka, Yifan Lu +4Medical VLMsOOD Detection

  14. Confidence Calibration for Multimodal LLMs: An Empirical Study through Medical VQA

    Jun 18, 2026Yuetian Du, Yucheng Wang, Ming Kong +4Multimodal QALanguage Model Calibration

  15. REVEAL++: Differentiable Phenotypic Grouping for Vision-Language Retinal Modeling of Alzheimer's Disease Risk

    Jun 17, 2026Ethan Elio Meidinger, Seowung Leem, Zeyun Zhao +1Contrastive LearningMedical Image Analysis

  16. Hallucination Detection and Correction in Medical VLMs via Counter-Evidence Verification

    Jun 17, 2026Nan Zhou, Ke Zou, Meng Liu +5Hallucination Detection in VLMsVision-Language Models

  17. Evaluation of Medical Vision Language Models HuluMed and MedGemma, and general purpose chatbots Gemma 3, ChatGPT Plus, and Claude Pro on real previously unseen wound images

    Jun 16, 2026Yunzhe Xue, Mohammed Saim Ahmed Quadri, Neal Panse +2VLM EvaluationMedical VQA

  18. The Slop Paradox: How Synthetic Standardization Erodes Clinical Uncertainty and Cross-Modal Alignment in AI-Rewritten Radiology Reports

    Jun 16, 2026Samar AnsariMedical VLMsVision-Language Alignment

  19. Enhancing Pathological VLMs with Cross-scale Reasoning

    Jun 16, 2026Chi Phan, Tianyi Zhang, Qiaochu Xue +5Visual Question AnsweringComputational Pathology

  20. Revisiting LLM Adaptation for 3D CT Report Generation: A Study of Scaling and Diagnostic Priors

    Jun 15, 2026Vanshali Sharma, Andrea M. Bejar, Halil Ertugrul Aktas +43D Medical ImagingMedical VLMs

  21. Vision-Language Models as Zero-Annotation Oracles in Histopathology

    Jun 15, 2026Vishal Jain, Giorgio Buzzanca, Sarah Cechnicka +6Computational PathologyHistopathology Image Segmentation

  22. Uncertainty Is Not a Safety Net for Clinical VQA, but Can It Anticipate Model Failure?

    Jun 15, 2026Arnisa Fazla, Alberto Testoni, Ameen Abu-Hanna +2VLM EvaluationVLM Robustness

  23. Unified Multimodal Model for Brain MRI Imputation and Understanding

    Jun 15, 2026Zhiyun Song, Che Liu, Tian Xia +2Missing-Modality LearningUnified Multimodal Models

  24. Calibrated Triage, Not Autonomy: Confidence Estimation for Medical Vision-Language Models

    Jun 14, 2026Reza Khanmohammadi, Kundan Thind, Mohammad M. GhassemiVLM EvaluationSelective Prediction

  25. Object Tokens as a Bridge Between Segmentation and Visual Question Answering in Robotic Surgery

    Jun 14, 2026Yiping Li, Ronald de Jong, Romy van Jaarsveld +5Medical VQASurgical Video Understanding

  26. ReportQA: QA-Based Radiology Report Evaluation

    Jun 13, 2026Yiming Shi, Shaoshuai Yang, Xi Chen +10Radiology Report GenerationMedical VLMs

  27. OpenMedQ: Broad Open Pretraining for Medical Vision-Language Models

    Jun 11, 2026Ibrahim Gulluk, Max Van Puyvelde, Olivier GevaertMedical VQAMedical Image Classification

  28. Analyzing and Improving Fine-grained Preference Optimization in Medical LVLMs

    Jun 10, 2026Shayan Mohammadizadehsamakosh, Pritam Sarkar, Leonid Sigal +2Medical VLMsMedical Image Grounding