Medical VQA

VQA: Visual Question Answering

Momentum

10 papers in the last four weeks, up 67% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 115

All topics
CardsList
  1. A doctrine-grounded visual question answering dataset for Tactical Combat Casualty Care

    Oct 5, 2026Junseob Kim, Jade Chng, Ayman Ali +5Medical VQAVideo QA

  2. MedPrune: Topology-Efficient Multimodal Multi-Agent Communication Evolution for Medical VQA Tasks

    Oct 5, 2026Jiuheng Wan, Runze Li, Chen Chen +5Medical VQAMulti-Agent Collaboration

  3. BrainTRACE: Tracing Longitudinal, Multimodal, and Volumetric Evidence in Brain MRI Clinical Reasoning

    Oct 5, 2026Qizhen Lan, Mengchen Fan, Hang Zhang +5VLM Evaluation3D Medical Imaging

  4. CineMR: Tool-Integrated Vision-Language Reasoning for Quantitative Cardiac MRI Assessment

    Oct 1, 2026Kunyang Li, Hai Nguyen, Joshua Lowe +6Tool Use in VLMsMedical VQA

  5. Learning Where to Look: Anatomical Grounding and Guided Attention for Cardiac MRI Vision-Language Models

    Sep 30, 2026Bangwei Guo, Xiao Chen, Boris Mailhe +8Medical VQAMedical Image Grounding

  6. CRAFT: Causal Responsibility and Failure Tracing in Medical Vision Language Models

    Sep 30, 2026Chunzheng Zhu, Jiaqi Zeng, Hongbo Zhao +3Vision-Language ModelsMedical VQA

  7. See, Measure, and Reason: Learning Visually Grounded Reasoning in Pathology

    Sep 28, 2026Chengyang Zhang, Wenchuan Zhang, Bo Li +8Computational PathologyMedical VQA

  8. Representation-guided in-context learning for medical image interpretation with multimodal large language models

    Sep 21, 2026Minda Zhao, Fangyu Hu, Yan Luo +8Medical Image AnalysisMultimodal Large Language Models

  9. A Unified Vision-Language Model for PSMA PET/CT Report Generation, Visual Question Answering, and Lesion Segmentation

    Sep 14, 2026Yang Xing, Jiong Wu, Savas Ozdemir +11Radiology Report GenerationMedical VQA

  10. Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQA

    Sep 14, 2026Tristan Kirscher, Niklas C. Koser, Soren PirkVLM AdaptationMultiple-Choice Question Answering

  11. STSG-VQA: Evidence-Grounded Temporal Question Answering from Surgical Spatio-Temporal Scene Graphs

    Sep 8, 2026Jing Li, Duygu SarikayaMedical VQAQuestion Answering

  12. A visual large language foundational model for medical image recognition using clinician-contributed online resources

    Sep 7, 2026Lingxuan Hou, Yuhua Xie, Yue Hu +14Medical VQAMedical VLMs

  13. MedQA-MM: Shortcuts Behind Medical Visual Reasoning

    Sep 3, 2026Benlu Wang, Yifan Zhang, Jiaqing Yu +7Medical VQAShortcut Learning

  14. Candidate-Expanding Routing with Permutation-Stabilized Experts for Mixed-Format Medical VQA

    Sep 1, 2026Hai-Dang Nguyen, Huy-Hieu PhamMemory-Augmented VLMsVisual Question Answering

  15. SlideBank: A Persistent Hierarchical Evidence Bank for Consistent Whole-Slide Reasoning

    Aug 31, 2026Beidi Zhao, Gexin Huang, Ciro Zhang +6Memory-Augmented VLMsMedical VQA

  16. Source-Dependent Deference in Medical Imaging Agents Under Falsified Findings: A Pilot Audit

    Aug 30, 2026Ridam Roy, Md Shahriar Rashid, Md. Rajib MiaTool-Use EvaluationMedical VQA

  17. Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence

    Aug 13, 2026Jakub Pokrywka, Łukasz Grzybowski, Antoni Lasik +3Medical VQAMultilingual VLM Evaluation

  18. CARE: Confidence-Aware Reasoning for Reliable Medical VQA

    Aug 11, 2026Yuetian Du, Yucheng Wang, Zhenyuan Chen +9Medical VQAMedical VLMs

  19. Agentic Visual Reasoning in Whole-Slide Pathology Images via Active Perception

    Aug 9, 2026Jingyun Chen, Fengchun Liu, Linghan Cai +5Active PerceptionMedical VQA

  20. Frequency-Domain Dual-Branch Fusion for Medical Visual Question Answering

    Aug 8, 2026Yusra Tariq, Rakesh Chandra JoshiMedical VQAMultimodal Fusion

  21. Beyond Relevance: Bayesian Evidence Acquisition for Agentic Whole-Slide Image Reasoning

    Aug 6, 2026Bryan Wong, Xun Xu, Huazhu Fu +2Visual Question AnsweringComputational Pathology

  22. CARVE: Cross-Slice Anisotropic Reallocation of Visual Evidence for Efficient 3D Medical Volume Understanding

    Aug 5, 2026Zhenyu Yi, Qiang Hu, Zhenhao Li +33D Medical ImagingMedical VQA

  23. SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomical Reasoning in Radiology Vision-Language Models

    Jul 30, 2026Satvik Tripathi, Mustafa Ege Seker, Kristian Quevada +8Radiology VLMsMedical Image Analysis

  24. PathView-Bench: Can Multimodal Large Language Models Achieve Fine-grained Multiscale Understanding of Pathology Images?

    Jul 30, 2026Zongyi Chen, Yu Liang, Jie Lin +1Computational PathologyMedical VQA

  25. LoMeVQA: A Comprehensive Benchmark for Longitudinal Medical VQA

    Jul 30, 2026Zhilin Wu, Zhangkai Ni, Chengmei Yang +4Longitudinal Medical Image AnalysisMedical VQA

  26. Position, Not Provenance: Separating Reasoning Mediation from Sycophancy in Medical Vision-Language Models

    Jul 29, 2026Supratik Bhowal, Subhrajyoti Basu, Aritra Gir Mahanta +1Medical VQAMedical VLMs