LLM Reliability

LLM: Large Language Model

Momentum

78 papers in the last four weeks, up 105% on the four weeks before. 0.8% of all new papers.

Jul 13Week of Sep 28

Latest papers 507

All topics
CardsList
  1. Measuring Five-Nines Reliability: Sample-Efficient LLM Evaluation in Saturated Benchmarks

    May 11, 2026Eungyeup Kim, Chenchen Gu, Vashisth Tiwari +1LLM EvaluationLLM Reliability

  2. Beyond Red-Teaming: Formal Guarantees of LLM Guardrail Classifiers

    May 11, 2026Nikita Kezins, Urbas Ekka, Pascal Berrang +1Neural Network VerificationLanguage Model Safety Evaluation

  3. ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models

    May 11, 2026Wentao Qiu, Guanran Luo, Zhongquan Jian +3Abductive ReasoningBayesian Networks

  4. Trust or Abstain? A Self-Aware RAG Approach

    May 11, 2026Xi Zhu, Ziqi Wang, Kai Mei +5Retrieval-Augmented GenerationKnowledge Conflicts in Language Models

  5. Can We Trust LLMs for Mental Health Screening? Consistency, ASR Robustness, and Evidence Faithfulness

    May 10, 2026Erfan Loweimi, Sofia de la Fuente Garcia, Samira Loveymi +2HealthcareMental Health

  6. APCD: Adaptive Path-Contrastive Decoding for Reliable Large Language Model Generation

    May 10, 2026Tianyu Zheng, Hong Wu, Jiaji ZhongLanguage Model DecodingLLM Reliability

  7. The Geometry of Forgetting: Temporal Knowledge Drift as an Independent Axis in LLM Representations

    May 9, 2026Rania Elbadry, Ahmed Heakl, Fan Zhang +4LLM InterpretabilityLLM Reliability

  8. DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding

    May 9, 2026Xiang Feng, Jiawei Zhou, Zhangfeng Huang +6LLM GroundingLLM Answer Verification

  9. A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering

    May 8, 2026Zhanliang Wang, Jiancong Xiao, Ruochen Jin +3LLM EvaluationConfidence Estimation in Language Models

  10. Sanity Checks for Long-Form Hallucination Detection

    May 8, 2026Geigh Zollicoffer, Minh Vu, Hongli Zhan +2LLM EvaluationHallucination Detection

  11. Beyond Confidence: Rethinking Self-Assessments for Performance Prediction in LLMs

    May 8, 2026Sree Bhattacharyya, Samarth Khanna, Leona Chen +3LLM EvaluationConfidence Estimation in Language Models

  12. Reliable Chain-of-Thought via Prefix Consistency

    May 8, 2026Naoto Iwase, Yuki Ichihara, Mohammad Atif Quamar +1Self-Consistency DecodingReasoning Consistency in Language Models

  13. Confidence-Aware Alignment Makes Reasoning LLMs More Reliable

    May 8, 2026Kejia Chen, Jiawen Zhang, Yihong Wu +5LLM AlignmentDirect Preference Optimization

  14. Limits of Reliability and Scaling in Language Models

    May 8, 2026Subhabrata MajumdarLanguage Model Scaling LawsAutoregressive Language Modeling

  15. Hallucination Detection via Activations of Open-Weight Proxy Analyzers

    May 8, 2026Akshita Singh, Prabesh Paudel, Siddhartha RoyHallucination in Language ModelsLLM Reliability

  16. The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval

    May 8, 2026Zekai Tong, Ruiyao Xu, Aryan Shrivastava +2LLM EvaluationLLM Reliability

  17. Knowing but Not Correcting: Routine Task Requests Suppress Factual Correction in LLMs

    May 7, 2026Zixuan Chen, Hao Lin, Zizhe Chen +6LLM Self-CorrectionLLM Reliability

  18. Hallucination as an Anomaly: Dynamic Intervention via Probabilistic Circuits

    May 7, 2026Erik Nielsen, Elia Cunegatti, Marcus Vukojevic +1Probabilistic CircuitsLLM Hallucination Mitigation

  19. MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Following

    May 5, 2026Jaeyun Lee, Junyoung Koh, Zeynel Tok +2LLM EvaluationLLM-as-a-Judge

  20. A multilingual hallucination benchmark: MultiWikiQHalluA

    May 4, 2026Freja Thoresen, Dan Saattrup SmartMultilingual Language ModelsMultilingual Language Model Evaluation