Medical LLMs

LLM: Large Language Model

Momentum

26 papers in the last four weeks, up 160% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Testing the Black Box: Structural Barriers to Independent Evaluation of Consumer-Facing Health LLMs

    Jun 7, 2026Rahul Gorijavolu, Kaushik Madapati, Pritika Vig +7LLM EvaluationLLM Sycophancy

  2. What's in a Name? Morphological Shortcuts by LLMs in Pharmacology

    Jun 4, 2026Kaijie Mo, Thomas Yang, Chantal Shaib +6Hallucination in Language ModelsLanguage Modeling

  3. Severity-Aware Curriculum Learning with Multi-Model Response Selection for Medical Text Generation

    Jun 3, 2026Ahmed Alansary, Molham Mohamed, Ali HamdiMedical QACurriculum Learning

  4. Ten Headache Specialists versus Artificial Intelligence for Clinical Literature Summarization: A Critical Evaluation and Comparison

    Jun 3, 2026Alejandro Lozano, Keiko Ihara, Ping-Hao Yang +13Text SummarizationRAG Evaluation

  5. When Retrieval Doesn't Help: A Large-Scale Study of Biomedical RAG

    Jun 2, 2026Erfan Nourbakhsh, Rocky Slavin, Ke Yang +1Retrieval-Augmented GenerationLLM Grounding

  6. Selective Token-Level Cryptographic Redaction for Privacy-Preserving Clinical Deployment of Large Language Models

    Jun 2, 2026Farhan Sheth, Ziyuan Yang, Yongying Lan +1Privacy-Preserving Language ModelsMedical LLMs

  7. ClinicalMC: A Benchmark for Multi-Course Clinical Decision-Making with Large Language Models

    Jun 2, 2026Ruihui Hou, Siyi Zhu, Ziyue Huai +4Clinical Decision-MakingClinical Language Model Evaluation

  8. Large AI Models in Dental Healthcare: From General-Purpose Systems to Domain-Specific Foundation Models

    Jun 1, 2026Sema Helali, Lina Abu Nada, Sausan Al Kawas +3Medical Imaging Foundation ModelsMedical VLMs

  9. Towards Multidisciplinary Summarization of Hospital Stays: Efficient Sentence-Level Clinical Provenance Categorization

    Jun 1, 2026Baris Karacan, Vaibhav Bhargava, Barbara Di Eugenio +21Data ProvenanceLLM Fine-Tuning

  10. Med-HEAL: Analyzing and Mitigating Hallucinations in Medical LLMs with Hallucination-Aware In-Context Learning

    May 31, 2026Yiming Liao, Zeno Franco, Jose Eduardo Lizarraga Mazaba +1LLM Self-CorrectionLLM Hallucination Mitigation

  11. HypothesisMed: Inference-Time Answer Fusion and Structured Hypothesis-Space Reporting for Biomedical Question Answering

    May 31, 2026Md Motaleb Hossen Manik, Ge WangBiomedical QALLM Uncertainty Estimation

  12. Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs

    May 28, 2026Mahdi Alkaeed, Adnan Qayyum, Nabeel Abo Kashreef +2Prompt SensitivityClinical Language Model Evaluation

  13. OOD-GraphLLM: Graph Large Language Model for Out-of-Distribution Generalized Drug Synergy Prediction

    May 28, 2026Xin Wang, Linxin Xiao, Yang Yao +1OOD GeneralizationMultimodal Graph Learning

  14. Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence

    May 28, 2026Yanan Wang, Shuaicong Hu, Jian Liu +3Multi-Agent LLM SystemsHealthcare

  15. Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Models in Clinical Text

    May 27, 2026Bushi Xiao, Sarvesh Soni, Daisy Zhe WangText SummarizationLLM Uncertainty Estimation

  16. SafeMed-R1: Clinician-Audited Safety and Ethics Alignment for Medical Large Language Models

    May 27, 2026Chao Ding, Mouxiao Bian, Tianbin Li +12HealthcareLLM Auditing

  17. When Medical Safety Alignment Fails: A Benchmark for Evaluating LLMs on High-Risk Medical Queries

    May 26, 2026Yige Li, Jun Sun, Wei Zhao +5LLM Safety BenchmarksHealthcare

  18. MedGuideX: Internalizing Decision Logic from Executable Guidelines into Large Language Models for Clinical Reasoning

    May 26, 2026Yuhao Shen, Lang Cao, Simo Du +4HealthcareClinical Decision Support

  19. The Daily Dose: Workflow-Integrated Large Language Model Automation for Clinical Summarization and Trial Identification in Radiation Oncology

    May 25, 2026Jason Holmes, Federico Mastroleo, Mariana Borras-Osorio +17HealthcareClinical Decision Support

  20. Uncertainty Reasoning with Large Language Models for Explainable Disease Diagnosis

    May 25, 2026Xiaoyang Fan, Yufan Cai, Zhe Hou +1Clinical Decision SupportClinical Reasoning

  21. Towards end-to-end LLM-based censoring-aware survival analysis

    May 25, 2026Yishu Wei, Hexin Dong, Yi Lin +3Survival AnalysisMortality Prediction

  22. HiMed: Incentivizing Hindi Reasoning in Medical LLMs

    May 23, 2026Dingfeng Jiang, Han Yan, Chenze Ma +12Multilingual Language ModelsHealthcare

  23. When Symptoms Are Not Enough: Evidence-Weighting Patterns in Large Language Model Psychiatric Screening

    May 22, 2026Jianfeng Zhu, Megan Korhummel, Ruoming Jin +1Medical DiagnosisMental Health

  24. Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models

    May 20, 2026Fernando Ortega, Raúl Lara-Cabrera, Jorge Dueñas-Lerín +3LLM Fine-TuningClinical Information Extraction

  25. Do No Harm? Hallucination and Actor-Level Abuse in Web-Deployed Medical Large Language Models

    May 20, 2026Sunday Oyinlola Ogundoyin, Muhammad Ikram, Rahat MasoodLanguage Model Safety EvaluationHealthcare