LLM Reliability

LLM: Large Language Model

Momentum

78 papers in the last four weeks, up 105% on the four weeks before. 0.8% of all new papers.

Jul 13Week of Sep 28

Latest papers 507

All topics
CardsList
  1. Semantic Self-Distillation for Language Model Uncertainty

    Feb 4, 2026Edward Phillips, Sean Wu, Fredrik K. Gustafsson +2Uncertainty QuantificationConfidence Estimation in Language Models

  2. HALT: Hallucination Assessment via Log-probs as Time series

    Feb 2, 2026Ahmad Shapiro, Karan Taneja, Ashok GoelLanguage Model Error DetectionHallucination Detection

  3. Uncertainty Localization in LLM Reasoning via Embedding Perturbations

    Feb 2, 2026Qihao Wen, Jiahao Wang, Yang Nan +3LLM ReliabilityLLM Uncertainty Estimation

  4. MGSM-Pro: A Simple Strategy for Robust Multilingual Mathematical Reasoning Evaluation

    Jan 29, 2026Tianyi Xu, Kosei Uemura, Alfred Malengo Kondoro +6Numerical Reasoning in Language ModelsMathematical Reasoning Benchmarks

  5. Bayesian-LoRA: Probabilistic Low-Rank Adaptation of Large Language Models

    Jan 28, 2026Moule Lin, Shuhao Guan, Andrea Patane +2Bayesian Neural NetworksConfidence Estimation in Language Models

  6. AdversaRiskQA: An Adversarial Factuality Benchmark for High-Risk Domains

    Jan 21, 2026Adam Szelestey, Sofie van Engelen, Tianhao Huang +3Factual Consistency EvaluationLLM Reliability

  7. Relational Linearity is a Predictor of Hallucinations

    Jan 16, 2026Yuetian Lu, Yihong Liu, Sebastian Gerstner +3LLM InterpretabilityHallucination in Language Models

  8. Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations

    Jan 12, 2026Yuxi Xia, Dennis Ulmer, Terra Blevins +3LLM EvaluationConfidence Estimation in Language Models

  9. Not All Needles Are Found: How Fact Distribution and Don't Make It Up Prompts Shape Retrieval, Reasoning, and Hallucination in Long-Context LLMs

    Jan 5, 2026Amirali Ebrahimzadeh, Seyyed M. SaliliLong-Context RetrievalLLM Hallucination Mitigation

  10. Honesty over Accuracy: Trustworthy Language Models through Reinforced Hesitation

    Nov 14, 2025Mohamad Amin Mohamadi, Tianhao Wang, Zhiyuan LiRL for Language ModelsLLM Hallucination Mitigation

  11. A Quantitative Study of Sustained Focus in Large Language Models via Repetitive Deterministic Prediction Tasks

    Nov 2, 2025Wanda Hou, Leon Zhou, Hong-Ye Hu +3LLM EvaluationLLM Reliability

  12. Reasoning Up the Instruction Ladder for Controllable Language Models

    Oct 30, 2025Zishuo Zheng, Vidhisha Balachandran, Chan Young Park +2LLM Safety AlignmentInstruction Following

  13. Rethinking Reward Models for Multi-Domain Test-Time Scaling

    Oct 1, 2025Dong Bok Lee, Seanie Lee, Sangwoo Park +12Reward ModelingLLM Evaluation

  14. Training-free Truthfulness Detection via Sparse MLP Value Vectors

    Sep 22, 2025Runheng Liu, Heyan Huang, Xingchen Xiao +2LLM ReliabilityLLM Hallucination Detection

  15. Clotho: Measuring Task-Specific Pre-Generation Test Adequacy for LLM Inputs

    Sep 22, 2025Juyeon Yoon, Somin Kim, Robert Feldt +1LLM EvaluationLLM Reliability

  16. Geometric Uncertainty for Detecting and Correcting Hallucinations in LLMs

    Sep 17, 2025Edward Phillips, Sean Wu, Soheila Molaei +3Uncertainty QuantificationLLM Hallucination Mitigation

  17. Addressing Benchmarking Gaps in Large Language Models for Health and Medicine with Dynamic Red-Teaming

    Jul 30, 2025Jiazhen Pan, Bailiang Jian, Paul Hager +20LLM Safety BenchmarksLanguage Model Safety Evaluation

  18. Post-Training Large Language Models via Reinforcement Learning from Self-Feedback

    Jul 29, 2025Carel van Niekerk, Renato Vukovic, Benjamin Ruppik +3RL for Language ModelsRL for Language Model Reasoning

  19. The Trilemma of Truth in Large Language Models

    Jun 30, 2025Germans Savcisens, Tina Eliassi-RadLLM InterpretabilityLLM Reliability

  20. Popular but Wrong: Understanding and Mitigating LLM Overconfidence through Knowledge Popularity

    May 23, 2025Shiyu Ni, Keping Bi, Jiafeng Guo +1LLM Hallucination MitigationConfidence Estimation in Language Models

  21. HoT: Highlighted Chain of Thought for Referencing Supporting Facts from Inputs

    Mar 3, 2025Tin Nguyen, Logan Bolton, Mohammad Reza Taesiri +2LLM GroundingLLM Answer Verification

  22. Prompting the Unknown: Understanding Response Uncertainty in Large Language Models

    Jul 20, 2024Ze Yu Zhang, Arun Verma, Finale Doshi-Velez +1LLM PromptingLLM Reliability

  23. VeriSim: A Configurable Framework for Stress-Testing Medical AI Under Patient Communication Noise

    Date pendingSina Mansouri, Mohit Marvania, Vibhavari Ashok Shihorkar +5HealthcareLLM Reliability

  24. ActMap: Single-Pass Uncertainty Quantification from Generation-Time Activation Maps

    Date pendingJacopo Dardini (University of Bologna), Roberta Calegari (University of Bologna)Uncertainty QuantificationConfidence Estimation in Language Models