Medical Image Benchmarks

Latest papers 237

All topics
CardsList
  1. PathLang: A Language-Centered Benchmark for Vision-Language Models in Computational Pathology

    Oct 8, 2026Fanqi Cheng, Kuo Gong, Shangke Liu +15VLM EvaluationMedical VLMs

  2. MedBenchAgent: Towards Systematic Automation of Medical VLM Benchmark Construction

    Oct 8, 2026Yulin Fu, Junren Wang, Guangjing Yang +5Medical Image BenchmarksVLM Evaluation

  3. Performance at What Cost? A Sustainability-Aware Performance Index for Cell and Nucleus Instance Segmentation

    Oct 7, 2026Eiram Mahera Sheikh, Alaa Tharwat, Wolfram SchenckInstance SegmentationCost-Aware Inference

  4. Multi-Dataset Diagnostic Utility of Clinical Visual Concepts in AI Systems for Dermatology

    Oct 6, 2026Linda Wermelinger, Simone Lionetti, Fabian Gröger +6Skin Lesion ClassificationExplainable Medical Image Analysis

  5. WILLIE: A Unified Framework and Benchmark for Wound Classification, Segmentation, and Localization

    Oct 4, 2026Gopi Trinadh Maddikunta, Shannan Hamlin, Hsin-Mei Chen +2Multi-Task LearningMedical Image Segmentation

  6. MIRTO: a registration-gated, multiverse-tested evaluation protocol for unsupervised anomaly segmentation in brain MRI

    Oct 1, 2026Negin Kafee Hernashki, Soumick ChatterjeeAnomaly LocalizationUnsupervised Anomaly Detection

  7. CineMR: Tool-Integrated Vision-Language Reasoning for Quantitative Cardiac MRI Assessment

    Oct 1, 2026Kunyang Li, Hai Nguyen, Joshua Lowe +6Tool Use in VLMsMedical VQA

  8. The RSNA Intracranial Aneurysm (RSNA-ICA) Dataset

    Oct 1, 2026Maria Correia de Verdier, Rachit Saluja, Jason Sho +37Medical Image Anomaly DetectionMedical Image Localization

  9. Scores That Hold, Benchmarks That Leak: Measuring Dataset Contamination in Public Brain-Tumor MRI Classification

    Sep 30, 2026Bhanu Prakash Vangala, Sowmya Guda, Latha Peddi +1Data LeakageBenchmark Contamination

  10. Learning Where to Look: Anatomical Grounding and Guided Attention for Cardiac MRI Vision-Language Models

    Sep 30, 2026Bangwei Guo, Xiao Chen, Boris Mailhe +8Medical VQAMedical Image Grounding

  11. Evaluation Choices Shape Biomedical ML Claims: A Pediatric Pneumonia Benchmark Case Study

    Sep 29, 2026Bhanu Prakash Vangala, Sowmya Guda, Latha Peddi +1Data LeakageChest X-Ray Classification

  12. Merlin Plus: A Large-Scale, Multi-Cancer, Image-Mask-Report Dataset

    Sep 29, 2026Pedro R. A. S. Bassi, Wenxuan Li, Szymon Plotka +10Medical Image SegmentationComputed Tomography

  13. Generative AI-Based Data Augmentation for Oral Lesion Classification: The PhotoMOCI Dataset and Benchmark

    Sep 28, 2026Marco Parola, Mario G. C. A. Cimino, Sabrina SenatoreSynthetic Data AugmentationMedical Imaging

  14. UltraBench 2: Towards Robust Evaluation of Vision Foundation Models on Ultrasound

    Sep 23, 2026Ashwath Radhachandran, Adam Tupper, Christian Gagné +1Ultrasound Image SegmentationMedical Imaging Foundation Models

  15. Faithful Faithfulness Evaluations: Challenges & Pitfalls Learned from a Breast MRI Case Study

    Sep 22, 2026Peachapong Poolpol, Henrik H. J. Detjen, Eike PetersenPerturbation-Based Feature AttributionSaliency Map Evaluation

  16. Brain Metastases Segmentation for BraTS 2026 Task 1: A Multi-Architecture Comparison

    Sep 21, 2026Mahdi Islam, Musarrat TabassumU-NetMedical Image Segmentation

  17. ERCPMP-Gx: Endoscopic Image and Video Dataset for Morphological, Histopathological, and Genomic Characterization of Colorectal Polyposis

    Sep 17, 2026Zahra Ghaffari, Massih Bahar, Mojgan Forootan +2EndoscopyMedical Image Benchmarks

  18. Benchmarking Intra-Patient 3D Deformable Multimodal Image Registration

    Sep 14, 2026Matteo Barbieri, Giammarco La Barbera, Juan Pablo De La Plata +3Medical Image RegistrationCross-Modal Image Registration

  19. Assessing nnU-Net Generalization across Brain Tumor Populations in BraTS-GoAT 2026

    Sep 14, 2026Tristan Kirscher, Vivian Metzger, Philippe Meyer +1Neural Network GeneralizationU-Net

  20. Pre- and Post-Treatment Brain Metastases Segmentation Using nnU-Net with Post-Processing for BraTS 2026

    Sep 11, 2026Haobin Liu, Xin WangMedical Image SegmentationMedical Image Benchmarks

  21. Evaluation Principles for MRI-MRA Registration in Trigeminal Neuralgia: An ROI-Centered Neurovascular Benchmark

    Sep 8, 2026Xupeng Zhang, Xihang Wang, Michael Xie +6Medical Image RegistrationNeuroimaging

  22. A visual large language foundational model for medical image recognition using clinician-contributed online resources

    Sep 7, 2026Lingxuan Hou, Yuhua Xie, Yue Hu +14Medical VQAMedical VLMs

  23. MetaStructAtlas: A Grounded 3D Vision-Language Dataset and Benchmark for Functional and Structural Reasoning in Whole-Body PET/CT

    Sep 3, 2026Chenguang Zheng, Le Xue, Yichi Zhang +8PET/CT ImagingMedical VLMs

  24. MedQA-MM: Shortcuts Behind Medical Visual Reasoning

    Sep 3, 2026Benlu Wang, Yifan Zhang, Jiaqing Yu +7Medical VQAShortcut Learning

  25. RadMatch: Auditable Radiology Report Evaluation via Finding-Level Matching

    Sep 1, 2026Charles Corbière, Léo Machado, Aubin Charley +3LLM-as-a-JudgeMedical Image Benchmarks

  26. A multicenter benchmark and clinically structured metric for coronary CTA report generation

    Sep 1, 2026Zhiyu Ye, Yue Sun, Limiao Zou +7VLM EvaluationRadiology Report Generation