Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Primary ICD Category Prediction using LLM-based Probing

    Jun 27, 2026Chengyuan Liu, Xinyue Zhang, Yao Li +1Automated Medical CodingLinear Probing

  2. An AI agent for treatment reasoning over a biomedical tool universe

    Jun 27, 2026Shanghua Gao, Ayush Noori, Richard Zhu +13Clinical Decision-MakingLLM Agent Training

  3. Bridging the Post-discharge Gap: A Traceable Multi-agent Framework for Safe and Continuous Care

    Jun 24, 2026Runwei Guan, Yi Zhou, Heyi Lin +12Retrieval-Augmented GenerationMulti-Agent LLM Systems

  4. RADIANT-PET: Reasoning-Augmented PET/CT Lesion Segmentation with Large Language Models and Reinforcement Learning

    Jun 23, 2026Jiasheng Wang, Tanun Jitwatcharakomol, Piyawadee Jongpradubgiat +1PET/CT ImagingMedical Image Segmentation

  5. A specialized reasoning large language model for accelerating rare disease diagnosis: a randomized AI physician assistance trial

    Jun 23, 2026Haichao Chen, Songchi Zhou, Zhengyun Zhao +28Rare Disease DiagnosisClinical Decision Support

  6. One Year Later...The Harms Persist, But So Do We!

    Jun 22, 2026Annika Marie Schoene, Cansu Canca, Gautham Vijay Kumar +1Mental HealthAdversarial Attacks on LLMs

  7. Trade-offs in Medical LLM Adaptation: An Empirical Study in French QA

    Jun 17, 2026Ikram Belmadani, Oumaima El Khettari, Carlos Ramisch +3LLM Fine-TuningDomain-Adaptive Pretraining

  8. Beyond Scalar Scores: Exploring LLM-based Metrics for Clinical Significance Evaluation in Radiology Reports

    Jun 17, 2026Qingyu Lu, Ruochen Li, Liang Ding +3Clinical Language Model EvaluationLanguage Model Robustness

  9. AIPatient Arena: EHR-grounded evaluation of large language models in end-to-end clinical consultation workflows

    Jun 16, 2026Jiahui Niu, Huizi Yu, Wenkong Wang +11Clinical ReasoningClinical Language Model Evaluation

  10. Teaching agentic AI to generalize expert diagnostic reasoning in rare diseases

    Jun 15, 2026Minh-Ha Nguyen, Erica Gray, Bryce A. Schuler +16RL for Language ModelsRare Disease Diagnosis

  11. PVminerLLM2: Improving Structured Extraction of Patient Voice via Preference Optimization

    Jun 15, 2026Samah Fodeh, Linhai Ma, Ganesh Puthiaraju +7HealthcareClinical Information Extraction

  12. ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning

    Jun 12, 2026Sicheng Yang, Hangjie Yuan, Wenjun Zhang +5Multimodal HallucinationClinical Reasoning

  13. Trust but Verify: Mitigating Medical Hallucinations via Post-Hoc Adversarial Auditing and Multi-Agent Feedback Loops

    Jun 12, 2026Muhammad Osama, Maheera Amjad, Zartasha Mustansar +2Multi-Agent LLM SystemsLLM Hallucination Mitigation

  14. ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

    Jun 11, 2026Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya +2Multilingual Language ModelsRL for Language Model Reasoning

  15. Mental-R1: Aligning LLM Reasoning for Mental Health Assessment

    Jun 11, 2026Xin Wang, Boyan Gao, Yibo Yang +1Cognitive ModelingMedical Diagnosis

  16. sebis at CRF Filling 2026: A Two-Stage Local LLM Pipeline for Medical CRF Filling

    Jun 11, 2026Katharina Sommer, Tristan Till, Florian MatthesLLM GroundingPrivacy-Preserving Language Models

  17. Deployment-Centered Evaluation: Predicting Query-Level Rejection Risk in a Clinical LLM System

    Jun 10, 2026Alyssa Unell, Miguel Fuentes, Brenna Li +4LLM GuardrailsClinical Language Model Evaluation

  18. eCREAM-MedCorpus A Large-Scale Corpus of Clinical Notes for Italian

    Jun 10, 2026Tiziano Labruna, Guido Bertolini, Pietro Ferrazzi +1Document Information ExtractionClinical Information Extraction

  19. Measuring Epistemic Resilience of LLMs Under Misleading Medical Context

    Jun 10, 2026Hongjian Zhou, Xinyu Zou, Jinge Wu +19LLM ReliabilityMedical QA

  20. Lung-R1: A Knowledge Graph-Guided LLM for Pulmonary Diagnostic Reasoning

    Jun 10, 2026Haoyang Zeng, Yuanxi Fu, Rongzhen Li +11Medical DiagnosisClinical Reasoning

  21. Clinically Grounded Privacy Evaluation of Medical LMs

    Jun 8, 2026Sasha Ronaghi, Sana Tonekaboni, Lena Stempfle +6Data LeakageMemorization in Language Models

  22. LLM-Orchestrated Conformance Checking in Stroke Care Without Computer-Interpretable Guidelines

    Jun 8, 2026Giorgio Leonardi, Stefania Montani, Manuel Striani +2HealthcareProcess Mining

  23. Baichuan-M4: A Clinical-Grade Medical Agent System for Continuous Care

    Jun 8, 2026Aiyuan Yang, Canbin Piao, Chengfeng Dou +25RL for Language ModelsHealthcare

  24. CARE: A Conformal Safety Layer for Medical Summarization

    Jun 8, 2026Suhana Bedi, Bridget Lin, Anson Y. Zhou +5Text SummarizationConformal Risk Control

  25. From Hazard Functions to Language Space: Cox-Supervised Distillation of Survival Risk into a Large Language Model

    Jun 8, 2026Nicholas I-Hsien Kuo, Blanca Gallego, Louisa JormSurvival AnalysisLanguage Model Calibration

  26. PACT: Learning Diverse Diagnostic Strategies via Privileged Synthesis and Branch Consensus

    Jun 8, 2026Gen Li, Yuanze Hu, Zhichao Yang +10Medical DiagnosisClinical Reasoning