Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Employing General-Purpose and Biomedical Large Language Models with Advanced Prompt Engineering for Pharmacoepidemiologic Study Design

    Apr 20, 2026Xinyao Zhang, Nicole Sonne Heckmann, Manuela Del Castillo Suero +2LLM EvaluationHealthcare

  2. RePrompT: Recurrent Prompt Tuning for Integrating Structured EHR Encoders with Large Language Models

    Apr 20, 2026Arya Hadizadeh Moghaddam, Drew Ross, Mohsen Nayebi Kerdabadi +2Representation LearningPrompt Tuning

  3. Evaluating Multimodal LLMs for Inpatient Diagnosis: Real-World Performance, Safety, and Cost Across Ten Frontier Models

    Apr 18, 2026Bruce A. Bassett, Amy Rouillard, Sitwala Mundia +8Language Model Safety EvaluationHealthcare

  4. Improving Heart-Focused Medical Question Answering in LLMs via Variance-Aware Rubric Rewards with GRPO

    Apr 17, 2026Arash Ahmadi, Parisa Masnadi, Sarah Sharif +3RL for Language ModelsHealthcare

  5. Blinded Multi-Rater Comparative Evaluation of a Large Language Model and Clinician-Authored Responses in CGM-Informed Diabetes Counseling

    Apr 16, 2026Zhijun Guo, Alvina Lai, Emmanouil Korakas +6Clinical Decision SupportRAG Evaluation

  6. Enhancing Mental Health Counseling Support in Bangladesh using Culturally-Grounded Knowledge

    Apr 16, 2026Md Arid Hasan, Azhagu Meena SP, Aditya Khan +6Retrieval-Augmented GenerationMental Health Counseling

  7. Learning Diagnostic Reasoning for Decision Support in Toxicology

    Mar 31, 2026Nico Oberländer, David Bani-Harouni, Tobias Zellner +3Clinical Decision SupportRL for Language Model Reasoning

  8. Med-V1: Small Language Models for Zero-shot and Scalable Biomedical Evidence Attribution

    Mar 5, 2026Qiao Jin, Yin Fang, Lauren He +12LLM Answer VerificationHealthcare

  9. An evidence-guided reinforcement learning method to improve psychiatric reasoning in small language models

    Feb 6, 2026Xinxin Lin, Guangxin Dai, Yi Zhong +25HealthcareMental Health

  10. SycoEval-EM: Sycophancy Evaluation of Large Language Models in Simulated Clinical Encounters for Emergency Care

    Jan 23, 2026Dongshen Peng, Yi Wang, Austin Schoeffler +5LLM SycophancyLanguage Model Safety Evaluation

  11. Counterfactual Modeling with Fine-Tuned LLMs for Health Intervention Design and Sensor Data Augmentation

    Jan 21, 2026Shovito Barua Soumma, Asiful Arefeen, Stephanie M. Carpenter +2Counterfactual ExplanationsLLM Fine-Tuning

  12. Towards Explainable Conversational AI for Early Diagnosis with Large Language Models

    Dec 19, 2025Maliha Tabassum, M Shamim KaiserMedical DiagnosisConversational Agents

  13. Behavioral Coherence: A Method for Sensitive-Domain LLM Evaluation

    Dec 15, 2025Anika Sharma, Malavika Mampally, Chidaksh Ravuru +2Language Model Bias EvaluationDemographic Bias in Language Models

  14. Multilingual Medical Reasoning for Question Answering with Large Language Models

    Dec 5, 2025Pietro Ferrazzi, Aitor Soroa, Rodrigo AgerriKnowledge Augmentation for Language ModelsHealthcare

  15. Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning

    Nov 26, 2025Zhenchao Tang, Fang Wang, Haohuai He +13LLM AlignmentLLM Fine-Tuning

  16. MedBayes-Lite: A Clinical Uncertainty Governance Layer for Risk-Aware Medical Decision Support

    Nov 20, 2025Elias Hossain, Md Mehedi Hasan Nipu, Maleeha Sheikh +5Selective PredictionHealthcare

  17. MedRECT: A Bilingual Medical Reasoning Benchmark for Error Correction in Clinical Texts

    Nov 1, 2025Naoto Iwase, Hiroki Okuyama, Junichiro IwasawaMultilingual Language Model EvaluationHealthcare

  18. Expert-guided Clinical Text Augmentation via Query-Based Model Collaboration

    Sep 25, 2025Dongkyu Cho, Miao Zhang, Rumi ChunaraSynthetic Data AugmentationData Augmentation

  19. ProMed: Shapley Information Gain Guided Reinforcement Learning for Proactive Medical LLMs

    Aug 19, 2025Hongxin Ding, Baixiang Huang, Yue Fang +8RL for Language ModelsHealthcare

  20. FedCoT: Communication-Efficient Federated Reasoning Enhancement for Large Language Models

    Aug 7, 2025Chuan Li, Qianyi Zhao, Fengran Mo +1Communication-Efficient Distributed TrainingMedical LLMs

  21. Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications

    Aug 1, 2025Zizhan Ma, Wenxuan Wang, Meidan Ding +7LLM PromptingRL for Language Model Reasoning

  22. Addressing Benchmarking Gaps in Large Language Models for Health and Medicine with Dynamic Red-Teaming

    Jul 30, 2025Jiazhen Pan, Bailiang Jian, Paul Hager +20LLM Safety BenchmarksLanguage Model Safety Evaluation

  23. Learning Personalized Prompts for Healthcare Guidance

    Dec 20, 2024Ruize Shi, Hong Huang, Wei Zhou +3Prompt LearningLLM Personalization

  24. Narrative Feature or Structured Feature? A Study of Large Language Models to Identify Cancer Patients at Risk of Heart Failure

    Mar 18, 2024Ziyi Chen, Mengyuan Zhang, Mustafa Mohammed Ahmed +4HealthcareOncology

  25. Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation

    Date pendingZhiyao Ren, Yibing Zhan, Siyuan Liang +3HealthcareClinical Reasoning

  26. VeriSim: A Configurable Framework for Stress-Testing Medical AI Under Patient Communication Noise

    Date pendingSina Mansouri, Mohit Marvania, Vibhavari Ashok Shihorkar +5HealthcareLLM Reliability