Radiology Report Evaluation

Momentum

3 papers in the last four weeks, level with the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 17

All topics
CardsList
  1. Unmentioned Checklist Findings Change How Reinforcement Learning Appears to Improve Chest Radiograph Report Checking

    Oct 4, 2026Ali Vosoughi, Akhil Kasturi, Chenliang Xu +1Radiology VLMsRadiology Report Evaluation

  2. Can Jev Judge Radiology Reports? Evaluating a System One Model for Clinical Factuality

    Sep 23, 2026Jiaju Huang, Hao Yang, Xinyu Ma +6Radiology Report GenerationLLM-as-a-Judge

  3. Reporting Practice Matters: The Impact of Reference Choice on Chest X-ray Report Evaluation

    Sep 16, 2026Daniel P. Jeong, Charles Q. Li, Hossein Hosseiny +5Radiology Report GenerationGenerative AI Evaluation

  4. RadMatch: Auditable Radiology Report Evaluation via Finding-Level Matching

    Sep 1, 2026Charles Corbière, Léo Machado, Aubin Charley +3LLM-as-a-JudgeMedical Image Benchmarks

  5. A multicenter benchmark and clinically structured metric for coronary CTA report generation

    Sep 1, 2026Zhiyu Ye, Yue Sun, Limiao Zou +7VLM EvaluationRadiology Report Generation

  6. Error Detection for PET/CT Radiology Reports: Domain-Specific vs Large Language Models

    Aug 30, 2026Hermione Warr, Harry Anthony, Lilli J Freischem +3LLM EvaluationPET/CT Imaging

  7. Beyond Fluency: A Clinical Benchmark and Anomaly-Enhanced Baseline for Spine MRI Report Generation

    Aug 7, 2026Bruno Palau, Franziska Vogt, Daria Laslo +4VLM EvaluationRadiology Report Generation

  8. Prospective clinical indication, post-hoc report leakage, and fusion design in multi-image chest radiograph classification: a patient-clustered evaluation

    Jul 15, 2026Kamran Shahid, Muhammad Munwar IqbalData LeakageChest X-Ray Classification

  9. SHOVIR: A Benchmark for Evaluating Vision Shortcut Learning in Radiology Report Generation

    Jun 29, 2026Filippo Ruffini, Marco Salmé, Rosa Sicilia +2VLM EvaluationRadiology Report Generation

  10. Beyond Scalar Scores: Exploring LLM-based Metrics for Clinical Significance Evaluation in Radiology Reports

    Jun 17, 2026Qingyu Lu, Ruochen Li, Liang Ding +3Clinical Language Model EvaluationLanguage Model Robustness

  11. ReportQA: QA-Based Radiology Report Evaluation

    Jun 13, 2026Yiming Shi, Shaoshuai Yang, Xi Chen +10Radiology Report GenerationMedical VLMs

  12. RadOT-Eval: Auditable Structured-Evidence Transport for Radiology Report Evaluation

    Jun 7, 2026Weixin Liu, Juming Xiong, Yang Li +5Radiology Report GenerationAutomated Evaluation

  13. RadSEM: A Finding-by-Finding Metric for Clinical Consistency in Radiology Reports

    Jun 3, 2026Zhenhong Yang, Zhuoyun Liu, Jintao Fei +4Factual Consistency EvaluationAutomated Evaluation

  14. CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation

    Apr 27, 2026Ruifeng Yuan, Wanxing Chang, Weiwei Cao +4Radiology Report GenerationMedical Report Generation

  15. CXRMate-2: Structured Multimodal Temporal Embeddings and Tractable Reinforcement Learning for Clinically Acceptable Chest X-ray Radiology Report Generation

    Apr 21, 2026Aaron Nicolson, Elizabeth J. Cooper, Hwan-Jin Yoon +7Radiology Report GenerationRadiology VLMs

  16. Standardizing Longitudinal Radiology Report Evaluation via Large Language Model Annotation

    Jan 23, 2026Xinyi Wang, Grazziela Figueredo, Ruizhe Li +1Medical Report GenerationLLM-Assisted Annotation