cs.CLSep 28, 2026

AwarenessBench: Assessing Cognitive Capabilities of Language Models

Authors: Xiaojian Li, Rongwu Xu, Tianyun Zhang, Yue Wang, Shuo Chen, Qiner Lyu, Briana Zhang, Peiran Yang, +4 more

Organizations: Tsinghua University · Shanghai Qi Zhi Institute · Fangcun AI · Xi’an Jiaotong University · ShanghaiTech University · Carnegie Mellon University · Columbia University · University of Chinese Academy of Sciences

Abstract

As language models (LMs) exhibit increasingly consciousness-like behaviors, evaluating their cognitive abilities becomes essential. We introduce AwarenessBench, the first comprehensive benchmark for assessing the cognitive abilities of LMs in four dimensions: metacognition, self-awareness, social awareness, and situational awareness, covering 15 cognitive functions and 14,381 samples. Evaluating 18 state-of-the-art LMs, we find that all consistently surpass random baselines, with more advanced models performing better. We further compare LMs with human performance across three demographic groups, where the best-performing model surpasses human averages overall, but most still fall markedly short in metacognition and self-awareness. Finally, we show that awareness is a distinct capability: progress in language modeling or reasoning does not necessarily translate into improved cognition.

Figures & tables

Appendix figures & tables3 assets

Supplementary material from the paper’s appendix.

Appendix

Explore similar work

CardsList
  1. A Neuropsychologically Grounded Evaluation of LLM Cognitive Abilities

    Mar 3, 2026Faiz Ghifari Haznitrama, Faeyza Rishad Ardi, Alice OhCognitive ScienceWorking Memory

  2. Decomposing and Measuring Evaluation Awareness

    May 21, 2026Changling Li, Terry Jingchen Zhang, Jie Zhang +4Safety BenchmarksFrontier Models

  3. Decomposing and Steering Functional Metacognition in Large Language Models

    May 9, 2026Yanshi Li, Xueru Bai, Shuman Liu +2MetacognitionLLM Reasoning Strategies