LLM Uncertainty Estimation

LLM: Large Language Model

Latest papers 298

All topics
CardsList
  1. Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework

    Jul 9, 2026Riccardo Revalor, Jalees Rehman, Debjit PalCoT FaithfulnessLLM Reasoning with Graphs

  2. SpanUQ: Span-Level Uncertainty Quantification for Large Language Model Generation

    Jul 7, 2026Yimeng Zhang, Yingying Zhuang, Ziyi Wang +12LLM EvaluationConfidence Estimation in Language Models

  3. The "I Don't Know" Filter: Enhancing Agentic Reliability in Function Calling

    Jul 4, 2026Stefan Broecker, Mason del Rosario, Boris Selitser +1AI Agent ReliabilityLLM Agent Evaluation

  4. Bayesian Sparse Low-Rank Adaptation for Large Language Model Uncertainty Estimation

    Jul 2, 2026Jijie Zhang, Zhe Ren, Quan Zhang +1Low-Rank AdaptationLanguage Model Calibration

  5. Bayesian Uncertainty Propagation for Agentic RAG Pipelines: A Proof-of-Concept Study on Multi-Hop Question Answering

    Jul 1, 2026Louis Donaldson, Connor Walker, Koorosh Aslansefat +1Uncertainty QuantificationAgentic RAG

  6. Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs

    Jun 30, 2026Gabrielle Kaili-May Liu, Avi Caciularu, Gal Yona +2RL for Language ModelsReinforcement Learning

  7. Wisdom Of The (AI) Crowd: Investigating Artificial Swarm Intelligence In Large Language Models

    Jun 30, 2026Justin Brenne, Christian MeskeLLM Uncertainty EstimationLanguage Model Ensembles

  8. Uncertainty-Aware Generation and Decision-Making Under Ambiguity

    Jun 29, 2026Nico Daheim, Iryna GurevychIntelligent Tutoring SystemsLLM Decision-Making

  9. AB-RAG: Adaptive Budgeted Retrieval-Augmented Generation for Reliable Question Answering

    Jun 27, 2026Ansh KamthanRetrieval-Augmented GenerationLLM Answer Verification

  10. From Signals to Transfer: A Factorised Study of Probe-Based Uncertainty Estimation in Large Language Models

    Jun 26, 2026Ponhvoan Srey, Xiaobao Wu, Cong-Duy Nguyen +3Uncertainty QuantificationHallucination in Language Models

  11. Bayesian control for coding agents

    Jun 23, 2026Theodore Papamarkou, Vladislav Smirnov, Viktor Mazanov +4Language Model-Based ControlCoding Agents

  12. The Origins of Stochasticity: Comprehensive Investigations on Uncertainty Quantification for Large Language Models

    Jun 22, 2026Xiang-Jun Ou, Shuang Liang, Xin-Yu Hu +3LLM EvaluationUncertainty Quantification

  13. A Systematic Evaluation of Black-Box Uncertainty Estimation Methods for Large Language Models

    Jun 18, 2026Jiayi Wang, Xu-Yao ZhangLLM EvaluationUncertainty Quantification

  14. AURA: Adaptive Uncertainty-aware Refinement for LLM-as-a-Judge Auditing

    Jun 18, 2026Zilong Zhang, Yi-Ting Hung, Weiyi He +3LLM-as-a-JudgeLLM Auditing

  15. Uncertainty Decomposition for Clarification Seeking in LLM Agents

    Jun 17, 2026Gregory MatsnevLLM AgentsLLM Uncertainty Estimation

  16. LLM Doesn't Know What It Doesn't Know: Detecting Epistemic Blind Spots via Cross-Model Attribution Divergence on Clinical Tabular Data

    Jun 17, 2026Akshat Dasula, Prasanna Desikan, Jaideep SrivastavaLanguage Model CalibrationLLM Uncertainty Estimation

  17. A Risk Decomposition Framework for Pre-Hoc Fine-Tuning Prediction

    Jun 16, 2026Yuxiang Luo, Chen Wang, Nan TangFine-TuningLLM Fine-Tuning

  18. Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty

    Jun 15, 2026Baishali Chaudhury, Mengdie Flora Wang, Hyunji Hayley Park +3Reasoning Consistency in Language ModelsLLM Reliability