Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Large language models are vulnerable to incidental information in clinical documentation and reasoning

    Oct 6, 2026Krithik Vishwanath, Brandon Ye, Anton Alyakin +4Medical Report GenerationClinical Language Model Evaluation

  2. SAGE: Semantic Anchor-Guided Evolution for Grounded Medical QA Data Synthesis

    Oct 6, 2026Chuan Li, Chengyu Wang, Cen Chen +3Synthetic Data GenerationBiomedical QA

  3. Conditional Rank Allocation for Taxonomy-Aware Medical Language Model Adaptation

    Oct 5, 2026Guangyuan Dong, Ziwei Hong, Xuehao Zhou +6Low-Rank AdaptationDomain Adaptation for LLMs

  4. Aligning Multimodal Patient Evidence with Biomedical Knowledge Graphs for Clinical LLMs

    Oct 5, 2026Jiawen Du, Arshan Ali Khan, Chenhao Zhang +7KG ConstructionGraph-Based Retrieval

  5. HuatuoGPT-3: RL-Only Domain Adaptation from Base Models

    Oct 5, 2026Junying Chen, Xinyuan Xie, Ziniu Li +7RL for Language ModelsReinforcement Learning

  6. Single-Pass Uncertainty Heads for Claim-Level Hallucination Detection in Persian Medical Language Models

    Oct 2, 2026Mehrdad Ghassabi, Pedram Rostami, Hamidreza Baradaran Kashani +2Hallucination DetectionLLM Hallucination Detection

  7. Clinical Concept Centers in LLMs

    Oct 2, 2026Aishik Nagar, Abhishek Vaidyanathan, Arun-Kumar Kaliya-Perumal +2Mechanistic InterpretabilityCausal Interventions in Language Models

  8. Can LLMs Reason Over Long Horizons? An Empirical Evaluation of Context Strategies for Longitudinal Clinical Reasoning

    Sep 30, 2026Taye Akinrele, Noorbakhsh Amiri Golilarz, Subash Neupane +2Long-Context Language Model EvaluationClinical Reasoning

  9. Comparison of techniques for fine-tuning open-weight models for entity extraction from radiology reports

    Sep 30, 2026Aawez Mansuri, Kush Mehta, Mohammadreza Chavoshi +10Supervised Fine-TuningSynthetic Data Generation

  10. OverdoseMoE: A Multi-Expert Framework for Opioid Overdose Risk Prediction

    Sep 30, 2026Mingchen Li, Rohan Pandey, Junhui Qian +3Mixture of ExpertsLongitudinal EHR Modeling

  11. PrivMeSA: Privacy-Aware Self-Evolving Multi-Agent System for Medicine via Local-Remote LLM Collaboration

    Sep 29, 2026Dannong Wang, Yuran Zhang, Bian Sun +4Multi-Agent LLM SystemsPrivacy-Preserving Language Models

  12. PCQC: Privileged Counterfactual Question Credit for Multi-Turn Medical Dialogue

    Sep 23, 2026Chenxuan Li, Jiayi Wan, Xinrong Chen +3Clinical ReasoningMedical LLMs

  13. Syndrome, Synergy, and Safety: Structured Reasoning and Knowledge-Driven Alignment for TCM Prescription Generation

    Sep 22, 2026Zheng Chen, ZhiCheng Du, Haoxuan Li +1LLM AlignmentCoT Reasoning

  14. LingLan: An Advancing Traditional Chinese Medicine Diagnosis LLM with Multimodal Data

    Sep 22, 2026Zheng Chen, Zhicheng Du, Haoxuan Li +2Medical DiagnosisMultimodal Large Language Models

  15. Rewarding Reasoning, Not Answers: Fixing and Bounding Test-Time Reinforcement Learning on Medical QA

    Sep 15, 2026Kailong Fan, Anqi Pu, Yichen Wu +7Process Reward ModelsRL for Language Model Reasoning

  16. CLEAR: Cross-Source Evidence Adjudication for Large Language Models in Medicine

    Sep 14, 2026Shuai Wang, Yize Zhao, Qingyu ChenRetrieval-Augmented GenerationKnowledge Conflicts in Language Models

  17. EMR: Self-Evolving Medical Multi-Agent System via Experience Mining and Reuse

    Sep 14, 2026Dongsheng Shi, Yue Li, Xin Yi +1Continual Learning for LLM AgentsMulti-Agent LLM Systems

  18. Medical Knowledge Simplification for Patients in the Era of LLMs: A Case Study on Diabetes

    Sep 14, 2026Pallika Kafle, Yipeng Zhou, Guanfeng Liu +2HealthcareClinical NLP

  19. Route, Don't Fix: Regime-Dependent Decoding Correction and a Trajectory-Gated Router for Reliable Clinical LLM Answer Selection

    Sep 13, 2026Zeyu Dong, Benjamin Wang, Joyee W. JinAdaptive InferenceLanguage Model Decoding

  20. A primer on evaluation methods for large language models in healthcare

    Sep 13, 2026Suzannah E McKinney, Phuc Vu, Samuel A Justice +7LLM EvaluationClinical Language Model Evaluation

  21. Scaling Clinical Judgment to Evaluate Medical AI

    Sep 11, 2026Thomas A. Buckley, Zahir Kanjee, Peter G. Brodeur +15LLM-as-a-JudgeLLM Fine-Tuning