LLM Uncertainty Estimation

LLM: Large Language Model

Latest papers 298

All topics
CardsList
  1. Ask or Assume? Uncertainty-Aware Clarification-Seeking in Coding Agents

    Mar 27, 2026Nicholas Edwards, Sebastian SchusterMulti-Agent LLM SystemsAI Coding Agents

  2. The Anatomy of Uncertainty in LLMs

    Mar 26, 2026Aditya Taparia, Ransalu Senanayake, Kowshik Thopalli +1LLM AuditingLLM Reliability

  3. INTRYGUE: Induction-Aware Entropy Gating for Reliable RAG Uncertainty Estimation

    Mar 23, 2026Alexandra Kuleshova, Andrei Volodichev, Daria Kotova +1Hallucination DetectionLLM Interpretability

  4. Learning When to Sample: Confidence-Aware Selective Sampling for Efficient Chain-of-Thought Reasoning

    Mar 9, 2026Juming Xiong, Kevin Guo, Congning Ni +7CoT ReasoningEfficient Language Model Reasoning

  5. On Calibration of Large Language Models: From Response To Capability

    Feb 14, 2026Sin-Han Yang, Cheng-Kuang Wu, Chieh-Yen Lin +3LLM EvaluationConfidence Estimation in Language Models

  6. Decomposed Prompting Does Not Fix Knowledge Gaps, But Helps Models Say "I Don't Know"

    Feb 4, 2026Dhruv Madhwal, Lyuxin David Zhang, Dan Roth +2LLM PromptingQuestion Decomposition

  7. Semantic Self-Distillation for Language Model Uncertainty

    Feb 4, 2026Edward Phillips, Sean Wu, Fredrik K. Gustafsson +2Uncertainty QuantificationConfidence Estimation in Language Models

  8. Uncertainty Localization in LLM Reasoning via Embedding Perturbations

    Feb 2, 2026Qihao Wen, Jiahao Wang, Yang Nan +3LLM ReliabilityLLM Uncertainty Estimation

  9. Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations

    Jan 12, 2026Yuxi Xia, Dennis Ulmer, Terra Blevins +3LLM EvaluationConfidence Estimation in Language Models

  10. Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning

    Nov 26, 2025Zhenchao Tang, Fang Wang, Haohuai He +13LLM AlignmentLLM Fine-Tuning

  11. MedBayes-Lite: A Clinical Uncertainty Governance Layer for Risk-Aware Medical Decision Support

    Nov 20, 2025Elias Hossain, Md Mehedi Hasan Nipu, Maleeha Sheikh +5Selective PredictionHealthcare

  12. Sequential Bayesian Evaluation of Large Language Model Behavior

    Nov 4, 2025Saatvik Kher, Shang Wu, Rachel Longjohn +2LLM EvaluationLanguage Model Generation Evaluation

  13. Geometric Uncertainty for Detecting and Correcting Hallucinations in LLMs

    Sep 17, 2025Edward Phillips, Sean Wu, Soheila Molaei +3Uncertainty QuantificationLLM Hallucination Mitigation

  14. PiCSAR: Probabilistic Confidence Selection And Ranking for Reasoning Chains

    Aug 29, 2025Joshua Ong Jun Leang, Zheng Zhao, Aryo Pradipta Gema +7Confidence Estimation in Language ModelsBest-of-N Sampling

  15. Toward Efficient Uncertainty in LLMs through Evidential Knowledge Distillation

    Jul 24, 2025Lakshmana Sri Harsha Nemani, P. K. Srijith, Tomasz KuśmierczykLLM Uncertainty EstimationUncertainty-Aware Knowledge Distillation

  16. On the Effect of Uncertainty on Layer-wise Inference Dynamics

    Jul 9, 2025Sunwoo Kim, Haneul Yoo, Alice OhLLM InferenceLLM Interpretability

  17. Popular but Wrong: Understanding and Mitigating LLM Overconfidence through Knowledge Popularity

    May 23, 2025Shiyu Ni, Keping Bi, Jiafeng Guo +1LLM Hallucination MitigationConfidence Estimation in Language Models

  18. Label-Confidence-Aware Uncertainty Estimation in Natural Language Generation

    Dec 10, 2024Qinhong Lin, Yinglun Feng, Yuhao Zhang +2Uncertainty QuantificationLLM Uncertainty Estimation

  19. Prompting the Unknown: Understanding Response Uncertainty in Large Language Models

    Jul 20, 2024Ze Yu Zhang, Arun Verma, Finale Doshi-Velez +1LLM PromptingLLM Reliability

  20. Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation

    Date pendingZhiyao Ren, Yibing Zhan, Siyuan Liang +3HealthcareClinical Reasoning

  21. ActMap: Single-Pass Uncertainty Quantification from Generation-Time Activation Maps

    Date pendingJacopo Dardini (University of Bologna), Roberta Calegari (University of Bologna)Uncertainty QuantificationConfidence Estimation in Language Models