Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Cognivia: A Cognitive Behavioral Therapy Copilot for Evidence-Based Mental Healthcare

    Jul 28, 2026Qi Chen, Siria Xiyueyao Luo, Jian Wang +3Mental Health CounselingConversational Agents

  2. CardioBench: A Real-World Data Benchmark for Evaluating Large Language Models in Clinically Authentic Cardiovascular Care Scenarios

    Jul 28, 2026Xiao Li, Mouxiao Bian, Zhaodi Wu +8HealthcareClinical Language Model Evaluation

  3. MedJudgeRAG: Option-Wise Evidence Judgment with Dynamic Knowledge Graphs for Medical MCQA

    Jul 24, 2026Seongwon Seo, Seung Hwan Cho, Young-Min KimGraph Retrieval-Augmented GenerationMedical QA

  4. MedGame: Storytelling Gamification Empowered by Large Language Models for Medical Education

    Jul 23, 2026Qian Wu, Xinrong Zhou, Zizhan Ma +8Educational TechnologyClinical Language Model Evaluation

  5. Improving Rare Medication Recommendation with Counterfactual Data Augmentation and Large Language Models

    Jul 23, 2026Shinhwan Kang, Soo Yong Lee, Jaewon Kim +2Clinical Decision SupportLarge Language Model-Based Recommendation

  6. OntoBook: Ontology-Grounded Synthetic Textbooks for Medical Encoder Pretraining

    Jul 21, 2026Rian Touchent, Éric de la ClergerieLanguage Model PretrainingAutomated Medical Coding

  7. Benchmarking Resource-Efficient LLMs for Research Topic Ontology Generation in the Biomedical Field

    Jul 20, 2026Tanay Aggarwal, Angelo Salatino, Francesco Osborne +1Relation ExtractionLLM Evaluation

  8. Evaluating Large Language Models on Misconceptions in Multi-Turn Medical Conversations

    Jul 14, 2026Monica Munnangi, Saiph SavageMulti-Turn Dialogue EvaluationClinical Language Model Evaluation

  9. Evidence-Grounded AI for Musculoskeletal Care

    Jul 14, 2026Wenjie Li, Yujie Zhang, Fanrui Zhang +34HealthcareClinical Decision Support

  10. From Many to Meaningful: Feature-Guided Zero-Shot Chronic Kidney Disease Screening Using Large Language Models

    Jul 14, 2026Muhammad Ashad Kabir, Sirajam MuniraZero-Shot LearningMedical Diagnosis

  11. MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation

    Jul 10, 2026Runhan Shi, Quan Zhou, Yuqian Xu +14HealthcareClinical Language Model Evaluation

  12. Trivial Prompt Reframing Bypasses Safety Guardrails in Googleś MedGemma-4B

    Jul 9, 2026Avi-ad Avraam BuskilaLLM Safety BenchmarksLanguage Model Safety Evaluation

  13. The complexities of patient-centred conversational artificial intelligence

    Jul 9, 2026João Matos, Olivia Buege, Donny Cheung +8Clinical TriageConversational Agents

  14. MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

    Jul 9, 2026Yuming Yang, Xiao Sun, Yuanwei Zou +6Mental HealthClinical Reasoning

  15. A safety-oriented hypothetico-deductive framework for AI-assisted differential diagnosis

    Jul 9, 2026Fan Ma, Mauro Giuffrè, Donald Wright +12Scientific ReasoningMedical Diagnosis

  16. Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning

    Jul 8, 2026Qi Peng, Jiatong Li, Sirui Huang +10Clinical ReasoningClinical Language Model Evaluation

  17. Medi-Gemma: A Hybrid Clinical Decision Support System Integrating Deterministic EMR Analytics and Retrieval-Augmented Generation

    Jul 6, 2026Mohammed Saim Ahmed Quadri, Yunzhe Xue, Justin W. Ady +1Retrieval-Augmented GenerationLLM Hallucination Mitigation

  18. Reinforcement Learning for Evidence-Seeking Diagnostic Reasoning with Large Language Models

    Jul 3, 2026Shengyi Hua, Kangzhe Hu, Conghui He +2Medical DiagnosisRL for Language Model Reasoning

  19. MedCalc-Pro: Solving Complex Medical Calculations with LLM Agents

    Jul 3, 2026Siran Zhao, Ruihui Hou, Ziyue Huai +2LLM Agent EvaluationLLM Tool Use

  20. FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

    Jul 1, 2026Zhiyun Zhang, Liwen Sun, Xiang Qian +1RL for Language Model ReasoningProcess Supervision

  21. Readable but Not Controllable: Neuron-Level Evidence for Medical LLM Hallucination

    Jun 30, 2026Vijay Vankadaru, Asha Matthews, Tanya Roosta +1LLM Hallucination MitigationLLM Interpretability

  22. RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation

    Jun 30, 2026Deyang Jiang, Haoran Wu, Ziyi Wang +4Rare Disease DiagnosisRL for Language Model Reasoning

  23. Team MKC at CLPsych 2026: Capturing and Characterizing Mental Health Changes through Social Media Timeline Dynamics

    Jun 30, 2026Kyomin Hwang, Hyeonjin Kim, Hyunho Lee +1Social Media AnalysisMedical LLMs

  24. Teaching LLMs to Recommend and Defer in Underrepresented Epilepsy Care

    Jun 30, 2026Shreyas Rajesh, Kartik Sharma, Tonmoy Monsoor +8Prompt LearningSelective Prediction

  25. Clinical Reasoning Graphs: Structured Evaluation of LLM Diagnostic Reasoning Reveals Competence Without Consistency

    Jun 29, 2026Nisarg A. PatelLLM EvaluationReasoning Consistency in Language Models

  26. TriageRA-CCF: Source-Side Clinical Confidence and Coverage Signals for Adaptive Rank Budgeting in Medical LLMs

    Jun 28, 2026Shucan Ji, Yining Huang, Hongliang GuoLow-Rank AdaptationMedical QA