Medical Image Benchmarks

Latest papers 237

All topics
CardsList
  1. DaX: Learning General Pathology Representations Across Scales

    Jun 5, 2026Bokai Zhao, Yiyang Zhang, Long Bai +3Pathology Foundation ModelsMedical Image Representation Learning

  2. MMBU: A Massive Multi-modal Biomedical Understanding Benchmark to Probe the Perception Capabilities of Vision-Language Models

    Jun 4, 2026Ryan D'Cunha, Alejandro Lozano, Xiaoxiao Sun +17Medical Image AnalysisMedical VLMs

  3. A Vision-language Framework for Comparative Reasoning in Radiology

    Jun 4, 2026Tengfei Zhang, Ziheng Zhao, Xiaoman Zhang +5Radiology VLMsLongitudinal Medical Image Analysis

  4. BreastGPT: A Multimodal Large Language Model for the Full Spectrum of Breast Cancer Clinical Routine

    Jun 3, 2026Yang Liu, Jiajin Zhang, Danyang Tu +8Breast CancerMedical Imaging

  5. CoralBay: A Self-Supervised CT Foundation Model

    Jun 2, 2026Ioannis Gatopoulos, Nicolas Känzig, Sebastian Otálora +1Medical Imaging Foundation Models3D Representation Learning

  6. Automated Report-Derived Oncology VQA Benchmark for Evaluating Vision-Language Models on 3D Medical Imaging

    Jun 1, 2026Bo Liu, Hanxue Gu, Xiangru Li +6VLM EvaluationMedical Imaging

  7. A Systematic Benchmark of Intraoperative Ultrasound-to-MR Synthesis for Brain Tumour Surgery

    May 30, 2026Olga Esteban-Sinovas, Santiago Cepeda, Ignacio Arrese +1Ultrasound ImagingMedical Image Synthesis

  8. ASAP: Advancing Medical Volumetric Representation Learning with Anatomy-aware Semantically-adaptive Pre-training

    May 30, 2026Rongsheng Wang, Fenghe Tang, Zihang Jiang +10Medical VLMsMedical Image Grounding

  9. Beyond Accuracy: Evaluating Efficiency, Robustness and Explainability in Deep Learning for Malaria Diagnosis

    May 29, 2026Olivier Kanamugire, Kerol DjoumessiEfficient Neural Network InferenceImage Corruption Robustness

  10. Fairness Beyond Demographics: Optimizing Performance Across Appearance-Based Hidden Cohorts in Medical Imaging

    May 28, 2026Milad Masroor, Cuong Nguyen, Kevin Wells +1Medical Image AnalysisAlgorithmic Fairness

  11. CardioLens: Revealing the Clinical Reality Gap of MLLMs via Multi-Sequence Cardiac MRI Evaluations

    May 28, 2026Zixian Su, Hongkai Zhang, Fan Gao +12Magnetic Resonance ImagingMedical VLMs

  12. Pocket-Dentist: On-Device Dental Image Understanding via Efficient Multimodal Large Language Models

    May 28, 2026Kai Bian, Xucheng Guo, Bin Chen +4Medical ImagingEfficient VLM Inference

  13. MeniOmni: A Structured Multimodal Benchmark for Holistic Meniscus Injury Assessment

    May 27, 2026Shurui Xu, Siqi Yang, Weiping Ding +4Radiology Report GenerationMedical Image Benchmarks

  14. Benchmarking Ultrasound Foundation Models for Fetal Plane Classification

    May 27, 2026Leya Barrientos, Yuexi Du, Nicha C. DvornekMedical Imaging Foundation ModelsMedical Image Classification

  15. Cesarean Scar Defect Segmentation in Transvaginal Ultrasound Images: a Dataset and Benchmark

    May 26, 2026Yuan Tian, Yue Li, Wei Xia +10Ultrasound Image SegmentationUltrasound Imaging

  16. Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening

    May 25, 2026Durjoy Dey, Aymane Ajbar, Yuhong YanHybrid CNN-Transformer ArchitecturesVision Transformer

  17. Benchmarking Pathology Foundation Models for Spatial Domain Understanding

    May 25, 2026Bokai Zhao, Yiyang Zhang, Yuanchi Zhu +6Pathology Foundation ModelsMedical Image Benchmarks

  18. Which Anatomy Matters Under Limited Labels? A Data-Efficient Anatomy-Aware Benchmark for Cardiac Pathology Prediction

    May 25, 2026Himanshu SinghHealthcareMedical Image Analysis

  19. How Far Has AI Come in Liver Fibrosis Staging? A Large-Scale Real-World Dataset and Benchmark

    May 25, 2026Yuanye Liu, Nannan Shi, Zhejia Zhang +20Medical Image ClassificationMedical Image Benchmarks

  20. Are We Overconfident in Models and Results for Semi-Supervised 3D Medical Image Segmentation?

    May 25, 2026Jun Li, Ziwei QinBenchmark ContaminationSemi-Supervised Medical Image Segmentation

  21. Methodology for Creating a Clinically Verified Dermoscopic Image Dataset

    May 24, 2026Kozachok Elena SergeevnaTraining Data CurationMedical Image Benchmarks

  22. MedicalRec: Medical recommender system for image classification without retraining

    May 23, 2026Roghayeh Taghavi, Aysa Hasanazde Bashkandi, Amir Ali Bengari +5Model SelectionHealthcare

  23. Med-R2: An Adversarial Benchmark for Evidence-Grounded Reasoning in Medical VLMs

    May 23, 2026Wen Ma, Fucheng Niu, Zhiting Fan +3Adversarial Attacks on VLMsHealthcare

  24. EchoVQA: Enabling Conversational Assistance for Point-of-Care Cardiac Ultrasound

    May 22, 2026Filippos Bellos, Yutong Li, Jessie N Dong +6Medical VQAEchocardiography

  25. DDX-TRACE: A Benchmark for Medical Diagnostic Trajectories in VLMs

    May 22, 2026Jiazhen Pan, Weixiang Shen, Jun Li +7Medical ImagingRadiology VLMs

  26. Exploiting Longitudinal Context in Clinician-Verified Interactive Lesion Tracking

    May 22, 2026Yannick Kirchhoff, Maximilian Rokuss, Daniel Philipp Mertens +5Interactive Medical Image SegmentationMedical Imaging

  27. RoboSurg-VQA: A Multimodal Benchmark for Surgical Segmentation-Aware Visual Question Answering

    May 21, 2026Chengyi Zhang, Zi Ye, Ziyang WangMedical VQAMedical Image Benchmarks

  28. Towards Clinically Interpretable Ophthalmic VQA via Spatially-Grounded Lesion Evidence

    May 21, 2026Xingyue Wang, Bo Liu, Meng Wang +4Medical VQAFundus Imaging