Clinical QA

QA: Question Answering

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 38

All topics
CardsList
  1. BEACON-SP: Ontology-Grounded GraphRAG Framework for Clinical Suicide Risk Assessment

    Oct 6, 2026Kemal Davaslioglu, Nathan Conger, Sastry Kompella +2Graph Retrieval-Augmented GenerationClinical Decision Support

  2. Auditable Clinical Timeline Reconstruction with Provenance-Aware Evidence Graphs

    Oct 5, 2026Judith Jeyafreeda AndrewData ProvenanceClinical QA

  3. MS-Exam-Gen: Source-Grounded Benchmark Construction for Evaluating LLMs on Textual Multiple Sclerosis MRI Knowledge

    Oct 5, 2026Abdul Basit, Muhammad Abdullah Hanif, Muhammad ShafiqueLLM EvaluationSynthetic Benchmark Generation

  4. Evaluating Biomedical Reranking for LLM-Based Question Answering over Longitudinal Clinical Notes

    Oct 1, 2026Maryam Shahbaz Ali, Laura B. Strachan, Caitlin Sherman +3Cross-Encoder RerankingRetrieval-Augmented Generation

  5. GLoC-EHR: Evidence-Cited Clinical Reasoning over Global Context and Local EHR Events

    Oct 1, 2026Chaiho Shin, Kwangsoo KimEvidence-Grounded ReasoningClinical Outcome Prediction

  6. EHR-RobustGym: Benchmarking and Training Agents for Robust Clinical Reasoning

    Sep 30, 2026Yitong Qiao, Yancheng Jin, Lei Liu +4Evidence-Grounded ReasoningAI Agent Benchmarks

  7. A Living Benchmark for Information Retrieval from Electronic Health Records

    Sep 24, 2026Jordan L. Cahoon, Chloe O. Stanwyck, Sulaiman Somani +23Synthetic Benchmark GenerationClinical QA

  8. Verifiable by Construction: Claim-Level Evaluation of Verbatim Citation in Clinical Question Answering

    Sep 14, 2026Jiashuo Zhang, Yuling Chen, Yvonne Commodore-Mensah +1LLM GroundingLLM Answer Verification

  9. SentryLine: Evidence-Grounded Question Answering over Evolving Documents in Oncology Care

    Sep 8, 2026Tampu Ravi Kumar, Gaurav Najpande, Muhammad Ali Khan +7Question AnsweringClinical QA

  10. ClinTraceBench: Source-Verifiable Longitudinal Clinical Reasoning over EHR-Derived Dialogues

    Sep 1, 2026Huimin Wang, Zhengyi Zhao, Yutian ZhaoClinical QAClinical Reasoning

  11. Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions

    Aug 13, 2026Qingfang Liu, Qiao Jin, Joe D. Menke +2Clinical QAInformation Retrieval

  12. Grounded in Consensus, In Step With Emerging Science: A Consensus-Anchored Multi-Corpus Clinical Chatbot for Long COVID

    Jul 27, 2026Yining Wu, Philip DiGiacomo, Ying Ding +1Retrieval-Augmented GenerationClinical Decision Support

  13. CLIR-Bench: Benchmarking Multimodal Question Answering over Irregular Clinical Time Series

    Jul 10, 2026Frank Nie, Ethan B. Liu, Yuan Zhu +3Irregular Time-Series ModelingTime Series QA

  14. Evaluating Large Language Model Raters for German Open-Response Clinical Questions: A Physician-Annotated Benchmark Study of Agreement, Evaluator Bias, and Abstention

    Jul 1, 2026William Philipp, Finn Fassbender, Daniel Fister +12Multilingual Language Model EvaluationLLM-as-a-Judge

  15. Expert Evaluation of Clinical AI Tools on Real Point-of-Care Clinical Queries

    Jun 27, 2026Jean Feng, Vishal Patel, Patrick Heagerty +5Clinical Decision SupportClinical QA

  16. EHRNote-ChatQA: A Benchmark for Evidence-Grounded Multi-Turn Clinical Question Answering over Longitudinal Discharge Summaries

    Jun 14, 2026Jiyoun Kim, Muhan Yeo, Eunhye Jang +14Clinical QAEvidence-Grounded Generation

  17. Trust but Verify: Mitigating Medical Hallucinations via Post-Hoc Adversarial Auditing and Multi-Agent Feedback Loops

    Jun 12, 2026Muhammad Osama, Maheera Amjad, Zartasha Mustansar +2Multi-Agent LLM SystemsLLM Hallucination Mitigation

  18. Med-HEAL: Analyzing and Mitigating Hallucinations in Medical LLMs with Hallucination-Aware In-Context Learning

    May 31, 2026Yiming Liao, Zeno Franco, Jose Eduardo Lizarraga Mazaba +1LLM Self-CorrectionLLM Hallucination Mitigation

  19. Better Accuracies, Worse Reasoning: A Step-Level Audit of Medical Chain-of-Thought Distillation

    May 27, 2026Zhaoyang Jiang, Xuanqi Peng, Fei Teng +5CoT DistillationCoT Evaluation

  20. When Cases Get Rare: A Retrieval Benchmark for Off-Guideline Clinical Question Answering

    May 20, 2026Doeun Lee, Muge Zhang, Yi Yu +11LLM GroundingHealthcare

  21. SEMA-RAG: A Self-Evolving Multi-Agent Retrieval-Augmented Generation Framework for Medical Reasoning

    May 16, 2026Yongfeng Huang, Ruiying Chen, James ChengRetrieval-Augmented GenerationHealthcare

  22. ClinicalBench: Stress-Testing Assertion-Aware Retrieval for Cross-Admission Clinical QA on MIMIC-IV

    May 11, 2026Alex StinardHealthcareClinical QA

  23. Neural at ArchEHR-QA 2026: One Method Fits All: Unified Prompt Optimization for Clinical QA over EHRs

    May 11, 2026Abrar Majeedi, Viswanatha Reddy Gajjala, Sai Prasanna Teja Reddy Bogireddy +1HealthcareClinical QA