Language Model Self-Assessment

Latest papers 56

All topics
CardsList
  1. Identifying Introspection From the Inside

    Oct 5, 2026David I. Atkinson, Dillon Plunkett, David BauLLM InterpretabilityLanguage Model Introspection

  2. Also Small Models Can Reasonably Self-Evaluate Their Confidence

    Sep 30, 2026Idil Kapikiran, Thomas Decker, Thomas RunklerConfidence Estimation in Language ModelsSmall Language Models

  3. Audio LLMs Know When They Can't Hear You

    Sep 24, 2026Amirhosein Javadi, Richa Dixit, Mehrdad Farajtabar +3Audio-Language Model EvaluationLanguage Model Self-Assessment

  4. When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control

    Sep 15, 2026Ali ŞenolSelective PredictionLLM Prompting

  5. The Assistant's Ideal Self

    Aug 31, 2026Mert YazanPersonality Modeling in Language ModelsLanguage Model Self-Assessment

  6. Evaluating and Improving LLM Self-Modeling

    Aug 31, 2026Siqi Zeng, Andre N. Assis, Rowan WangLLM EvaluationLanguage Model Introspection

  7. Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs

    Aug 12, 2026Vu Duc Anh, Nhat M. Hoang, Do Xuan Long +3LLM Self-CorrectionDirect Preference Optimization

  8. The Personalization Mirage: How LLMs Fabricate User Profiles, and Why Self-Monitoring Misleads

    Aug 5, 2026Yushi Sun, Yanjie Zhang, Rui ShengLLM EvaluationLLM Personalization

  9. How Much Does a Reasoning Summary Reveal? An Observability Ladder for Large Language Models

    Aug 3, 2026Andres Algaba, Francesca Carlon, Lynn Delcon +3LLM EvaluationLLM Interpretability

  10. Reflection or Re-Generation? Why LLM Revision Fails Where Human Revision Succeeds

    Jul 31, 2026Yefan Tao, Gerald Friedland, Madhusudhanan Chandrasekaran +1LLM Self-CorrectionLLM Self-Refinement

  11. SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute

    Jul 30, 2026Hongyu Chen, Liang Lin, Guangrun WangRL for Language Model ReasoningLanguage Model Self-Assessment

  12. One Human, NN Agents: Audit-Budget Allocation for LLM Agent Fleets under Miscalibrated, Correlated Confidence

    Jul 30, 2026Cesare Zavattari, Alessandro Tommasi, Giuseppe PrencipeScalable OversightAI Agent Reliability

  13. Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory

    Jul 27, 2026Saurabh Ranjan, Konstantina Sokratous, Brian OdegaardHallucination in Language ModelsLanguage Model Self-Assessment

  14. The Two-Process Theory of Machine Self-Report

    Jul 22, 2026Hubert Plisiecki, Filip Chmielewski, Kacper Dudzic +3Personality Modeling in Language ModelsLanguage Model Self-Assessment