Language Model Self-Assessment

Latest papers 56

All topics
CardsList
  1. FIFA World Cup 2026 as a Contamination-Free Benchmark for LLM Forecasting Agents: Four Models, a Bookmaker, and 104 Matches

    Jul 20, 2026Jiacheng Ding, Cong Guo, Jason XuLLM Agent EvaluationForecasting Benchmarks

  2. Diagnosing Correctness Probes under Self-Judgement Confounding

    Jul 18, 2026Yi-Long LuLLM InterpretabilityLanguage Model Self-Assessment

  3. Metacognition in LLMs: Foundations, Progress, and Opportunities

    Jul 13, 2026Gabrielle Kaili-May Liu, Areeb Gani, Jacqueline Lu +3Language Model Self-AssessmentMetacognition in Language Models

  4. Revealing Hidden Model Behaviors with Task-Specific Self-Reports

    Jul 3, 2026Taras Kutsyk, Bartosz ZielińskiLLM AuditingLanguage Model Introspection

  5. Latent Confidence Alignment for LLM Self-Assessment

    Jun 20, 2026Ting-Yu Chen, Tingting Yu, Pei-Cing Huang +3LLM EvaluationConfidence Estimation in Language Models

  6. Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data

    Jun 3, 2026XiuYu Zhang, Yi Shan, Junfeng Fang +1LLM EvaluationLLM-as-a-Judge

  7. CoEval: Ranking Language Models for Custom Tasks Without Labeled Data or Trustworthy Benchmarks

    Jun 2, 2026Alexander Apartsin, Yehudit ApersteinModel SelectionLLM Evaluation

  8. Capability Self-Assessment: Teaching LLMs to Know Their Limits

    May 29, 2026Haoyan Yang, Reza Shirkavand, Yukai Jin +3LLM EvaluationLanguage Model Self-Assessment

  9. What Am I Missing? Question-Answering as Hidden State Probing

    May 29, 2026Chu Fei Luo, Samuel Dahan, Xiaodan ZhuLLM Self-RefinementLanguage Model Self-Assessment

  10. Do as I Say, Not as I Do: Instruction-Induction Conflict in LLMs

    May 19, 2026Carolina Camassa, Derek ShillerLLM EvaluationLanguage Model Self-Assessment

  11. Beyond Confidence: Rethinking Self-Assessments for Performance Prediction in LLMs

    May 8, 2026Sree Bhattacharyya, Samarth Khanna, Leona Chen +3LLM EvaluationConfidence Estimation in Language Models

  12. EvoLM: Self-Evolving Language Models through Co-Evolved Discriminative Rubrics

    May 5, 2026Shuyue Stella Li, Rui Xin, Teng Xiao +8RL for Language ModelsLLM Evaluation

  13. Beyond "I Don't Know": Evaluating LLM Self-Awareness in Discriminating Data and Model Uncertainty

    Apr 19, 2026Jingyi Ren, Ante Wang, Yunghwei Lai +5LLM EvaluationSelective Prediction

  14. Introspection Adapters: Training LLMs to Report Their Learned Behaviors

    Apr 18, 2026Keshav Shenoy, Li Yang, Abhay Sheshadri +4LLM AuditingLanguage Model Introspection

  15. Are LLM Evaluators Really Narcissists? Sanity Checking Self-Preference Evaluations

    Jan 30, 2026Dani Roytburg, Matthew Bozoukov, Matthew Nguyen +3LLM-as-a-JudgeLanguage Model Generation Evaluation

  16. No Reliable Evidence of Self-Reported Sentience in Small Large Language Models

    Jan 20, 2026Caspar Kaiser, Sean EnderbyLLM EvaluationLanguage Model Self-Assessment

  17. Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations

    Jan 12, 2026Yuxi Xia, Dennis Ulmer, Terra Blevins +3LLM EvaluationConfidence Estimation in Language Models