Medical VLMs

VLM: Vision-Language Model

Momentum

22 papers in the last four weeks, up 22% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 266

All topics
CardsList
  1. Med-R2: An Adversarial Benchmark for Evidence-Grounded Reasoning in Medical VLMs

    May 23, 2026Wen Ma, Fucheng Niu, Zhiting Fan +3Adversarial Attacks on VLMsHealthcare

  2. Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome

    May 23, 2026Chen Zhan, Yingchen Wei, Xiaoyu Tan +2HealthcareClinical Triage

  3. SliceWorld: A Predictive and Controllable World-State Model for CT Report Generation

    May 23, 2026Yuanhe Tian, Yan SongRadiology Report GenerationWorld Model Learning

  4. JMed48k: A Multi-Profession Japanese Medical Licensing Benchmark for Vision-Language Model Evaluation

    May 21, 2026Yue Xun, Junyu Liu, Qian Niu +10VLM EvaluationHealthcare

  5. Universal CT Representations from Anatomy to Disease Phenotype through Agglomerative Pretraining

    May 21, 2026Yuheng Li, Yuan Gao, Haoyu Dong +5Medical Imaging Foundation ModelsMedical VLMs

  6. SurgOnAir: Hierarchy-Aware Real-Time Surgical Video Commentary

    May 20, 2026Jingyi He, Yue Zhou, Long Bai +3Streaming Video UnderstandingSurgical Video Understanding

  7. VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering

    May 20, 2026Jiayi Chen, Benteng Ma, Zehui Liao +3Hallucination Detection in VLMsHealthcare

  8. MedExpMem: Adapting Experience Memory for Differential Diagnosis

    May 20, 2026Qianhan Feng, Zhongzhen Huang, Yakun Zhu +4Radiology VLMsHealthcare

  9. HalluCXR: Benchmarking and Mitigating Hallucinations in Medical Vision-Language Models for Chest Radiograph Interpretation

    May 19, 2026Haoyu Wang, Zitong LiVision-Language ModelsAudio-Language Model Hallucination Detection

  10. Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models

    May 19, 2026Guangzhi Xiong, Qiao Jin, Sanchit Sinha +2Medical VQAVLM Interpretability

  11. Concept-Guided Noisy Negative Suppression for Zero-Shot Classification and Grounding of Chest X-Ray Findings

    May 19, 2026Chenyu Lian, Hong-Yu Zhou, Chun-Ka Wong +1Contrastive LearningChest X-Ray Classification

  12. MAM-CLIP: Vision-Language Pretraining on Mammography Atlases for BI-RADS Classification

    May 19, 2026Halil Ibrahim Gulluk, Olivier GevaertMedical ImagingMedical Image Classification

  13. MedFM-Robust: Benchmarking Robustness of Medical Foundation Models

    May 18, 2026Xiangxiang Cui, Tianjin Huang, Yifang Wang +2Multimodal RobustnessNeural Network Robustness

  14. Geometry-Aware Uncertainty Coresets for Robust Visual In-Context Learning in Histopathology

    May 18, 2026Franciskus Xaverius Erick, Johanna Paula Müller, Bernhard KainzVLM RobustnessIn-Context Learning

  15. Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering

    May 18, 2026Luca Hagen, Johanna P. Müller, Weitong Zhang +2HealthcareEfficient VLM Inference

  16. How Good LLMs Are at Answering Bangla Medical Visual Questions? Dataset and Benchmarking

    May 18, 2026Rafid Ahmed, Intesar Tahmid, Mir Sazzat Hossain +3VLM EvaluationMultilingual Language Model Evaluation

  17. Segmentation, Detection and Explanation: A Unified Framework for CT Appearance Reasoning

    May 15, 2026Yuyuan Liu, Can Peng, Yingyu Yang +3Image SegmentationMedical VLMs

  18. RoiMAM: Region-of-Interest Medical Attention Model for Efficient Vision-Language Understanding

    May 15, 2026Jiayan Yang, Zhuoyu Wu, Wenqi FangHealthcareEfficient VLM Inference

  19. DermAgent: A Self-Reflective Agentic System for Dermatological Image Analysis with Multi-Tool Reasoning and Traceable Decision-Making

    May 14, 2026Yize Liu, Siyuan Yan, Ming Hu +5Medical Image AnalysisLLM Agent Orchestration

  20. CA-GCL: Cross-Anatomy Global-Local Contrastive Learning for Robust 3D Medical Image Understanding

    May 13, 2026Hanwen Zhang, Yao Liu, Die Dai +4VLM RobustnessMedical Image Anomaly Detection

  21. Verification Mirage: Mapping the Reliability Boundary of Self-Verification in Medical VQA

    May 11, 2026Ruinan Jin, Beidi Zhao, Myeongkyun Kang +2VLM EvaluationVision-Language Models

  22. Med-StepBench: A Hierarchical Reasoning Framework for Evaluating Hallucinations in Medical Vision-Language Models

    May 11, 2026Minh Khoi Nguyen, Dai Lam Le, Amir Reza Jafari +8HealthcareHallucination Detection

  23. LiteMedCoT-VL: Parameter-Efficient Adaptation for Medical Visual Question Answering

    May 10, 2026Runze Ma, Shunbo Jia, Haonan Lyu +2CoT DistillationHealthcare

  24. Cross-Modal Semantic-Enhanced Diffusion Framework for Diabetic Retinopathy Grading

    May 10, 2026Yiqun WangDiabetic Retinopathy GradingMedical VLMs

  25. CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis

    May 8, 2026Haroon Wahab, Irfan Mehmood, Hassan UgailEndoscopyMedical Image Analysis

  26. MedVIGIL: Evaluating Trustworthy Medical VLMs Under Broken Visual Evidence

    May 8, 2026Hanqi Jiang, Junhao Chen, Mingyu Kang +12VLM EvaluationVLM Robustness

  27. Retina-RAG: Retrieval-Augmented Vision-Language Modeling for Joint Retinal Diagnosis and Clinical Report Generation

    May 7, 2026Abdelrahman Zaian, Sheethal Bhat, Mohamed Abdalkader +1Multimodal RAGMedical Report Generation

  28. FairEnc: A Fair Vision-Language Model with Fair Vision and Text Encoders for Glaucoma Detection

    May 6, 2026Mohamed Elhabebe, Ayman El-Baz, Qing LiuAlgorithmic FairnessAlgorithmic Bias

  29. MIRAGE: Retrieval and Generation of Multimodal Images and Texts for Medical Education

    May 6, 2026Miguel Diaz Benito, Cecilia Diana Albelda, Alvaro Garcia Martin +3Multimodal IREducational Technology