LLM Uncertainty Estimation

LLM: Large Language Model

Latest papers 298

All topics
CardsList
  1. Evaluation Pitfalls and Sparsity Limitations in LLM-based Confidence Estimates for Classification

    Aug 5, 2026Elena Merdjanovska, Omar Zaidan, Andreas RückléLLM EvaluationSelective Prediction

  2. PPDL: LLM-Based Flows as Probabilistic Programs

    Aug 5, 2026Louis Mandel, Guillaume Baudart, Mandana Vaziri +1LLM InferenceLLM Reliability

  3. DUD: Decoupled Update Dynamics for Reliable Uncertainty Quantification in Large Language Models

    Aug 4, 2026Yixin Bu, Runze Xia, Guanyun Zou +3LLM Uncertainty EstimationUncertainty Calibration

  4. Conformalized Large Language Models under Configuration Shift

    Aug 2, 2026Yuqicheng Zhu, Jialin Yu, Lin Li +7Conformal PredictionLanguage Model Calibration

  5. TrAC: Trace-Conditioned Answer Consistency for Efficient Uncertainty Quantification in LLMs

    Aug 1, 2026Dahai Yu, Lin Jiang, Rongchao Xu +1LLM EvaluationReasoning Consistency in Language Models

  6. SymboUQ: Symbolic Uncertainty Quantification for Spatial Reasoning in LLMs

    Aug 1, 2026Dahai Yu, Lin Jiang, Rongchao Xu +1Uncertainty QuantificationLLM Reliability

  7. Think Short, Defer Smart, Act, and Repeat: Calibrated Reasoning and Uncertainty-Aware Deferral for Edge LLM Agents

    Jul 29, 2026Amirmohammad Farzaneh, Osvaldo SimeoneLLM Inference EfficiencyAI Agent Reliability

  8. Thinking Under Uncertainty: Evidence Use and Information-Seeking in Language Models

    Jul 29, 2026Hua-Dong Xiong, Xinyuan Yan, Ji-An Li +3LLM Decision-MakingLLM Uncertainty Estimation

  9. Spend Experts Where You Are Unsure: Confidence-Adaptive Routing for Mixture-of-Experts LoRA

    Jul 28, 2026Tom Saliencro, Rohan Desai, Priya Nair +2Parameter-Free Mixture-of-Experts RoutingLLM Inference Acceleration

  10. Statistically Supported LLM Ingredient and Recipe Data Collection in Computational Nutrition

    Jul 25, 2026James Izzard, Hassan Eshkiki, Fabio CaraffiniLLM GroundingTraining Data Curation

  11. Calibrating Semantic Uncertainty from Observable Language-Model Probabilities

    Jul 20, 2026Matthew F. DixonUncertainty QuantificationConfidence Estimation in Language Models

  12. Beyond Semantic Equivalence: Logical Graphs for LLM Uncertainty Quantification

    Jul 18, 2026Yanni Dong, Minghua Liu, Meilin Zhu +2Reasoning Consistency in Language ModelsLLM Reliability

  13. The Computational Basis of Confidence in Large Language Models

    Jul 14, 2026Dharshan Kumaran, Viorica Patraucean, Maks Ovsanikov +2Confidence Estimation in Language ModelsLLM Uncertainty Estimation

  14. Critic Experience Bank: Self-Evolving Step-Level Confidence Estimation for LLM Agents

    Jul 14, 2026Yaopei Zeng, Congchao Wang, JianHang Chen +3AI Agent ReliabilityLLM Agent Evaluation

  15. Code-MUE: Measuring Code LLMs' Uncertainty through Execution-based Semantic Interaction Graphs

    Jul 14, 2026Xiaoning Ren, Yinxing Xue, Lei Ma +1Uncertainty QuantificationLLM Uncertainty Estimation

  16. Reliability Scaling Laws for Quantized Large Language Models

    Jul 12, 2026Sirine Ayadi, Sándor Daróczi, Stephan Günnemann +1LLM QuantizationLanguage Model Calibration

  17. Hallucination Detection in Large Language Models Using Diversion Decoding

    Jul 11, 2026Basel Abdeen, S M Tahmid Siddiqui, Meah Tahmeed Ahmed +4Hallucination in Language ModelsLLM Hallucination Detection

  18. Eigenvalue Calibration for Semantic Embeddings of Large Language Models

    Jul 9, 2026Sebastian G. Gruber, Nassim Walha, Francis Bach +1Confidence Estimation in Language ModelsLanguage Model Calibration