Clinician Trust

Momentum

9 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 39

All topics
CardsList
  1. Role-guided Speaker Deletion Verification in Clinical Psychiatry Speech Recordings with Audio Language Models

    Sep 29, 2026Joseph T Colonel, Daniel Katzman, Kelsey Kirker +6SpeakerClinician Trust

  2. KlinikeBench: Evaluating Language Models Beyond Diagnostic Accuracy

    Sep 29, 2026Xueting Fang, Zehui Li, Yang Yang +5Clinician TrustDiagnostic Benchmark

  3. Right Words, Wrong Moment: A Clinician-Grounded Analysis of Distress in 19,930 Conversations between Young People and ChatGPT

    Sep 28, 2026Marx Wang, Ella Zhang, Cameron Tan +11DistressClinician Trust

  4. A Living Benchmark for Information Retrieval from Electronic Health Records

    Sep 24, 2026Jordan L. Cahoon, Chloe O. Stanwyck, Sulaiman Somani +23Electronic Health RecordsClinician Trust

  5. Can Jev Judge Radiology Reports? Evaluating a System One Model for Clinical Factuality

    Sep 23, 2026Jiaju Huang, Hao Yang, Xinyu Ma +6Radiology Report GenerationClinician Trust

  6. When Rubrics Fail: Hallucinations Reveal Blind Spots in Medical AI Evaluation

    Sep 14, 2026Griffin Farrow, Lily Sijia Li, Jack Johnson +4Clinician TrustVisual Hallucinations

  7. LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study

    Sep 12, 2026Jorge López-Varela, J. Ignacio Hidalgo, José-Manuel Muñoz +6Symbolic RegressionExplainability

  8. Scaling Clinical Judgment to Evaluate Medical AI

    Sep 11, 2026Thomas A. Buckley, Zahir Kanjee, Peter G. Brodeur +15Clinician TrustOpen-Ended Responses

  9. Emergency Department Revisit Quality Review Screening: Exploring Human Decision-Making and Artificial Intelligence Support

    Sep 9, 2026Jonathan A. Handler, Marlene I. Robles-Granda, Jacob E. Mefford +5Clinician TrustEmergency Departments

  10. Augmenting Interviewer Judgments of Patient Experience with Automatic Language Analysis

    Aug 31, 2026Aowen Shi, Michal Balazia, Danilo Postin +4InterviewsClinician Trust

  11. Towards Expert-level Medical AI for Real-time Video Consultations

    Aug 10, 2026Mahvish Nagda, Jihyeon Lee, Matthew Thompson +37Multimodal Clinical DataClinician Trust

  12. Quality Action Assurance: Multimodal Verification of Examiner Claims in VR OSCEs

    Jul 21, 2026Harry Rogers, Sally Shiels, Ashley Tomlinson +5Reference-Guided Multimodal In-Context VerificationClinician Trust

  13. MedFailBench: A Clinician-Built Open-Source Benchmark for Medical AI Safety Boundary Inspection

    Jul 16, 2026Goktug OzkanArtificial Intelligence SafetyClinician Trust

  14. Clinician-Level Agreement Without Clinical Caution: LLM Evaluator Limits in Medical AI Benchmarking

    Jul 1, 2026William Philipp, Finn Fassbender, Thorsten Langer +11Clinician TrustLarge Language Model Evaluation

  15. The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing

    Jun 23, 2026Eileanor LaRocco, Sarah Tan, Adarsh Subbaswamy +4Medication LeafletClinician Trust

  16. Enhancing Clinician Decision-Making via Uncertainty-Aware Multi-Expert Fusion for Stroke Rehabilitation

    Jun 23, 2026Tamim Ahmed, Thanassis RikakisRehabilitationClinician Trust

  17. Before the Labels: How Dataset Construction Shapes Suicidality Detection in Clinical Text

    Jun 17, 2026Priyanshi Garg, Ishita Rao, Jieqiong Ding +1Suicide RiskElectronic Health Records

  18. Agentic AI Enhances Physician Trust in Clinical Decision Making

    Jun 16, 2026Zhiling Yan, Zhe Fang, David J King +10Clinician TrustClinical Decision Support

  19. CARE: A Conformal Safety Layer for Medical Summarization

    Jun 8, 2026Suhana Bedi, Bridget Lin, Anson Y. Zhou +5SummarizationLarge Language Model Safety

  20. Ten Headache Specialists versus Artificial Intelligence for Clinical Literature Summarization: A Critical Evaluation and Comparison

    Jun 3, 2026Alejandro Lozano, Keiko Ihara, Ping-Hao Yang +13SummarizationClinician Trust

  21. An explainable hierarchical self attention-based approach for tremor detection in the time domain

    May 30, 2026Timothy Odonga, Jeanne M. Powell, Mark Saad +5Time-FrequencySeizure Detection

  22. CandorMD: An AI-Assisted Audio Simulation and Feedback System for Training Clinicians for Medical Error Disclosure

    May 20, 2026Inna Wanyin Lin, Sahand Sabour, Hong Sng +4Simulated PatientsClinician Trust

  23. Evaluating the Utility of Personal Health Records in Personalized Health AI

    May 18, 2026Rory Sayres, Kejia Chen, Ayush Jain +19Electronic Health RecordsClinician Trust

  24. Resolving the bias-precision paradox with stochastic causal representation learning for personalized medicine

    May 7, 2026Peisong Zhang, Manqiang Peng, Yuxuan Wu +21Heterogeneous Treatment EffectsCausal Representation Learning

  25. Atomic Fact-Checking Increases Clinician Trust in Large Language Model Recommendations for Oncology Decision Support: A Randomized Controlled Trial

    May 5, 2026Lisa C. Adams, Linus Marx, Erik Thiele Orberg +8Clinician TrustFact-Checking

  26. ADAPTS: Agentic Decomposition for Automated Protocol-agnostic Tracking of Symptoms

    May 4, 2026Alexandria K. Vail, Marcelo Cicconet, Katie Aafjes-van Doorn +2DepressionMental Health

  27. Case-Specific Rubrics for Clinical AI Evaluation: Methodology, Validation, and LLM-Clinician Agreement Across 823 Encounters

    Apr 27, 2026Aaryan Shah, Andrew Hines, Alexia Downs +6Clinician TrustArtificial Intelligence Evaluation

  28. Reliability Auditing for Downstream LLM tasks in Psychiatry: LLM-Generated Hospitalization Risk Scores

    Apr 23, 2026Shevya Panda, Shinjini Bose, Ananya JoshiMental HealthClinician Trust

  29. MedSkillAudit: A Domain-Specific Audit Framework for Medical Research Agent Skills

    Apr 22, 2026Yingyong Hou, Xinyuan Lao, Huimei Wang +10Inter-Annotator AgreementClinician Trust

  30. Calibrated? Not for Everyone: How Sexual Orientation and Religious Markers Distort LLM Accuracy and Confidence in Medical QA

    Apr 19, 2026Alberto Testoni, Iacer CalixtoLarge Language Model ReliabilityClinician Trust

  31. DeepER-Med: Advancing Deep Evidence-Based Research in Medicine Through Agentic AI

    Apr 16, 2026Zhizheng Wang, Chih-Hsuan Wei, Joey Chan +19Deep ResearchClinician Trust

  32. Can LLMs Accurately Score Medical Diagnoses and Clinical Reasoning?

    Apr 16, 2026Amy Rouillard, Sitwala Mundia, Linda Camara +8Clinician TrustLarge Language Model Judges

  33. AI Chatbot Suicide Risk Detection and Response: Human Validation Study of the Open-Source VERA-MH Safety Evaluation

    Feb 4, 2026Kate H. Bentley, Luca Belli, Adam M. Chekroud +7Suicide RiskArtificial Intelligence Safety

  34. EndoCogniAgent: Closed-Loop Agentic Reasoning with Self-Consistency Validation for Endoscopic Diagnosis

    Aug 10, 2025Yi Tang, Kai-Ni Wang, Liang-Peng Pu +3ColonoscopyDiagnosis