LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Mind the Perspective: Let's Reason Recursively for Theory of Mind

    Jun 10, 2026Chao Lei, Guang Hu, Meng Yang +2Logical ReasoningTheory of Mind

  2. Can AI Reason Like an Urban Planner? Benchmarking Large Language Models Against Professional Judgment

    Jun 10, 2026Yijie Deng, He Zhu, Wen Wang +3LLM EvaluationUrban Planning

  3. LLMs+Graphs: Toward Graph-Native, Synergistic AI Systems

    Jun 10, 2026Arijit Khan, Longxu Sun, Xin HuangKnowledge Augmentation for Language ModelsLLM Reasoning with Graphs

  4. The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes

    Jun 9, 2026Avinash Anand, Mahisha Ramesh, Avni Mittal +7CoT ReasoningRL for Language Model Reasoning

  5. ReasonAlloc: Hierarchical Decoding-Time KV Cache Budget Allocation for Reasoning Models

    Jun 9, 2026Wenhao Liu, Hao Shi, Yunhe Li +7KV CachingMemory-Efficient Optimization

  6. Benchmarking Knowledge Editing using Logical Rules

    Jun 9, 2026Tatiana Moteu Ngoli, NDah Jean Kouagou, Hamada M. Zahera +1Knowledge EditingLLM Evaluation

  7. Optical Reasoning: Rethinking Images as an Expressive Reasoning Medium Beyond Text

    Jun 8, 2026Yutong Bian, Dongjie Cheng, Heming Xia +2Visual ReasoningMultimodal Reasoning

  8. Detecting Differences Is Not Understanding Structure: Large Language Models Fail at Graph Isomorphism

    Jun 8, 2026Kumar Thushalika, Sukumar Kishanthan, Asela HevapathigeLLM EvaluationLLM Reasoning with Graphs

  9. SEF-CLGC at SemEval-2026 Task 11: Logical Notation Impact on Language Model Performance

    Jun 8, 2026Hanna Abi Akl, Fabien Gandon, Catherine Faron +1Logical ReasoningSymbolic Reasoning

  10. Inference-Time Conformal Reasoning with Valid Factuality Control for Large Language Models

    Jun 7, 2026Ting Wang, Yuanjie Shi, Yan Yan +1LLM InferenceLLM Reasoning with Graphs

  11. PAEC: Position-Aware Entropy Calibration for LLM Reasoning in RLVR

    Jun 7, 2026Shumeng Yang, Yisu Liu, Jiayi Zheng +2RL for Language Model ReasoningMaximum Entropy RL

  12. Personalized and Robust Proactive Robot Assistance with Uncertainty-Guided LLM Reasoning

    Jun 7, 2026Alvaro Gonzalez, M. H. Hasan Shovo, Ali AyubMarkov ModelsAssistive Robotics

  13. How reliable are LLMs when it comes to playing dice?

    Jun 5, 2026Luca Avena, Gianmarco Bet, Bernardo BusoniLLM EvaluationLLM Prompting

  14. M3^3Exam: Benchmarking Multimodal Memory for Realistic User-Agent Interactions

    Jun 5, 2026Zhengjun Huang, Wenxuan Liu, Zhoujin Tian +6Multimodal GroundingEfficient Multimodal Inference

  15. Think Fast: Estimating No-CoT Task-Completion Time Horizons of Frontier AI Models

    Jun 5, 2026Dewi Gould, Francis Rhys Ward, Anders Cairns Woodruff +18LLM EvaluationAI Safety Evaluation

  16. DyCon: Dynamic Reasoning Control via Evolving Difficulty Modeling

    Jun 5, 2026Tengyao Tu, Yulin Li, Hui-Ling Zhen +6Overthinking in Language ModelsEfficient Language Model Reasoning

  17. RASFT: Rollout-Adaptive Supervised Fine-Tuning for Reasoning

    Jun 5, 2026Yongliang Miao, Fengyuan Liu, Wei Shi +4Supervised Fine-TuningLLM Mathematical Reasoning

  18. Quantum-Inspired Trace-Augmented Evidence Selection for Reasoning over Structured Hypothesis Spaces

    Jun 5, 2026Laura Wynter, Nirvik Sahoo, Paul GriffinEvidence-Grounded ReasoningCoT Reasoning

  19. ThinkBooster: A Unified Framework for Seamless Test-Time Scaling of LLM Reasoning

    Jun 5, 2026Vladislav Smirnov, Chieu Nguyen, Sergey Senichev +14LLM EvaluationTest-Time Scaling

  20. Skip a Layer or Loop It? Learning Program-of-Layers in LLMs

    Jun 4, 2026Ziyue Li, Yang Li, Tianyi ZhouLLM InferenceLLM Inference Acceleration

  21. Closing the Loop on Latent Reasoning via Test-Time Reconstruction

    Jun 4, 2026Xiaopeng Yuan, Haibo Jin, Ye Yu +4LLM InferenceTest-Time Training

  22. The Tell-Tale Norm: ℓ2\ell_2 Magnitude as a Signal for Reasoning Dynamics in Large Language Models

    Jun 4, 2026Jinyang Zhang, Hongxin Ding, Yue Fang +4LLM InterpretabilityTest-Time Scaling

  23. The Self-Correction Illusion: LLMs Correct Others but Not Themselves

    Jun 4, 2026Kuan-Yen Chen, Fang-Yi Su, Jung-Hsien ChiangLLM Self-CorrectionLLM Prompting

  24. Failed Reasoning Traces Tell You What Is Fixable (But Not by Reading Them)

    Jun 3, 2026Nizar Islah, Istabrak Abbes, Irina Rish +2Test-Time ScalingLLM Routing

  25. Imbuing Large Language Models with Bidirectional Logic for Robust Chain Repair

    Jun 3, 2026Zehua Cheng, Wei Dai, Jiahao Sun +1LLM Self-CorrectionSymbolic Reasoning

  26. DAR: Deontic Reasoning with Agentic Harnesses

    Jun 3, 2026Guangyao Dou, William Jurayj, Nils Holzenberger +1Logical ReasoningAgentic Reasoning