Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Synthesis and Evaluation of Long-term History-aware Medical Dialogue

    May 19, 2026Hebin Hu, Renke Dai, Ah-Hwee Tan +1HealthcareAI Agent Benchmarks

  2. Prompting language influences diagnostic reasoning and accuracy of large language models

    May 18, 2026Adrien Bazoge, Josselin Corvellec, Sofiane Djillali Sid-Ahmed +1Multilingual Language Model EvaluationLLM Prompting

  3. Evaluating the Utility of Personal Health Records in Personalized Health AI

    May 18, 2026Rory Sayres, Kejia Chen, Ayush Jain +19LLM PersonalizationHealthcare

  4. Fully Open Meditron: An Auditable Pipeline for Clinical LLMs

    May 15, 2026Xavier Theimer-Lienhard, Mushtaha El-Amin, Fay Elhassan +5HealthcareLLM Auditing

  5. COTCAgent: Preventive Consultation via Probabilistic Chain-of-Thought Completion

    May 14, 2026Zihan Deng, Xiaozhen Zhong, Chuanzhi XuHealthcareClinical Decision Support

  6. Quantifying and Mitigating Premature Closure in Frontier LLMs

    May 14, 2026Rebecca Handler, Suhana Bedi, Nigam ShahHealthcareLLM Prompting

  7. Agentifying Patient Dynamics within LLMs through Interacting with Clinical World Model

    May 14, 2026Minghao Wu, Yuting Yan, Zhenyang Cai +9Agentic RLClinical Decision Support

  8. IndicMedDialog: A Parallel Multi-Turn Medical Dialogue Dataset for Accessible Healthcare in Indic Languages

    May 13, 2026Shubham Kumar Nigam, Suparnojit Sarkar, Piyush PatelMultilingual Language ModelsHealthcare

  9. Large Language Models Lack Temporal Awareness of Medical Knowledge

    May 13, 2026Zihan Guan, Qiao Jin, Guangzhi Xiong +6HealthcareTemporal Reasoning in Language Models

  10. Training Large Language Models to Predict Clinical Events

    May 12, 2026Benjamin Turtel, Paul Wilczewski, Kris SkotheimHealthcareLanguage Model Calibration

  11. To Whom Do Language Models Align? Measuring Principal Hierarchies Under High-Stakes Competing Demands

    May 12, 2026Fangyi Yu, Nabeel Seedat, Jonathan Richard Schwarz +1LLM AlignmentLanguage Model Safety Evaluation

  12. AcuityBench: Evaluating Clinical Acuity Identification and Uncertainty Alignment

    May 12, 2026Robin Linzmayer, Georgianna Lin, Di Coneybeare +22HealthcareClinical Triage

  13. Medical Incident Causal Factors and Preventive Measures Generation Using Tag-based Example Selection in Few-shot Learning

    May 11, 2026Yuna Haseyama, Tomoki Ito, Hiroki Sakaji +1HealthcareFew-Shot Learning

  14. CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics

    May 10, 2026Aishik Nagar, Arun-Kumar Kaliya-Perumal, Yu-Hsuan Han +5HealthcareClinical Decision Support

  15. Human-LLM Dialogue Improves Diagnostic Accuracy in Emergency Care

    May 8, 2026Burcu Sayin, Ngoc Vo Hong, Ipek Baris Schlicht +8HealthcareClinical Decision Support

  16. Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?

    May 8, 2026Natalie Seah, Danielle S. Bitterman, Daphna Spiegel +1Breast CancerHealthcare

  17. MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs

    May 8, 2026Hsin-Ling Hsu, Zizheng Wang, Donghua Zhang +9HealthcareMedical Diagnosis

  18. Eliciting associations between clinical variables from LLMs via comparison questions across populations

    May 7, 2026Fabian Kabus, Kian Kordtomeikel, Thomas Brox +3LLM InterpretabilityCausal Structure Learning

  19. MedFabric and EtHER: A Data-Centric Framework for Word-Level Fabrication Generation and Detection in Medical LLMs

    May 5, 2026Tung Sum Thomas Kwok, Qian Qian, Xiaofeng Lin +8HealthcareHallucination Detection

  20. CuraView: A Multi-Agent Framework for Medical Hallucination Detection with GraphRAG-Enhanced Knowledge Verification

    May 5, 2026Severin Ye, Xiao Kong, Xiaopeng He +2HealthcareHallucination Detection

  21. Reliability-Oriented Multilingual Orthopedic Diagnosis: A Domain-Adaptive Modeling and a Conceptual Validation Framework

    May 4, 2026Danish Ali, Li Xiaojian, Sundas Iqbal +1Multilingual Language Model EvaluationHealthcare

  22. ReMedi: Reasoner for Medical Clinical Prediction

    May 2, 2026Yushi Cao, Yiming Chen, Hongchao Jiang +2Fine-TuningClinical Outcome Prediction

  23. Medmarks: A Comprehensive Open-Source LLM Benchmark Suite for Medical Tasks

    May 2, 2026Benjamin Warner, Ratna Sagari Grandhi, Max Kieffer +32LLM EvaluationHealthcare

  24. Teaching LLMs Brazilian Healthcare: Injecting Knowledge from Official Clinical Guidelines

    May 1, 2026Hugo Abonizio, Filipe Rocha Lopes, Roberto Lotufo +1Knowledge Augmentation for Language ModelsHealthcare

  25. CLEAR: Revealing How Noise and Ambiguity Degrade Reliability in LLMs for Medicine

    May 1, 2026Kevin H. Guo, Chao Yan, Avinash Baidya +5HealthcareLLM Reliability