LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. How Well Do LLMs Perform on the Simplest Long-Chain Reasoning Tasks: An Empirical Study on the Equivalence Class Problem

    May 7, 2026Chun Zheng, Lianlong Wu, Bingqian Li +2LLM EvaluationLLM Reasoning

  2. Extracting Search Trees from LLM Reasoning Traces Reveals Myopic Planning

    May 7, 2026Sixing Chen, Ji-An Li, Saner Cakir +3LLM PlanningLLM Interpretability

  3. When Does Critique Improve AI-Assisted Theoretical Physics? SCALAR: Structured Critic--Actor Loop for Agentic Reasoning

    May 7, 2026Vasilis Niarchos, Constantinos Papageorgakis, Alexander G. Stapleton +1AI for ScienceAI Agent Evaluation

  4. Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key

    May 7, 2026Tianle Wang, Zhaoyang Wang, Guangchen Lan +4Logical ReasoningRL for Language Model Reasoning

  5. SCRuB: Social Concept Reasoning under Rubric-Based Evaluation

    May 7, 2026Jamelle Watson-Daniels, Himaghna Bhattacharjee, Skyler Wang +11LLM EvaluationRubric-Based Evaluation

  6. Measuring Black-Box Confidence via Reasoning Trajectories: Geometry, Coverage, and Verbalization

    May 7, 2026Marc Boubnovski Martell, Josefa Lia Stoisser, Kaspar Märtens +4Confidence Estimation in Language ModelsCoT Reasoning

  7. Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning

    May 7, 2026Ömer Faruk Akgül, Rajgopal Kannan, Willie Neiswanger +1RL for Language Model ReasoningEfficient Language Model Reasoning

  8. Post-Reasoning: Improving the Performance of Non-Thinking Models at No Cost

    May 7, 2026Richmond Sin Jing Xuan, Rishabh Bhardwaj, Soujanya PoriaLLM PromptingLanguage Model Post-Training

  9. Logic-Regularized Verifier Elicits Reasoning from LLMs

    May 7, 2026Xinyu Wang, Changzhi Sun, Lian Cheng +4LLM EvaluationLLM Answer Verification

  10. Hypothesis generation and updating in large language models

    May 7, 2026Hua-Dong XiongLogical ReasoningBayesian Inference

  11. Formalizing Latent Thoughts: Four Axioms of Thought Representation in LLMs

    May 7, 2026Fahd Seddik, Fatemeh FardLLM EvaluationLLM Interpretability

  12. G-SHARE: A Guideline-Based Structured Reasoning Framework for Human-Factor Event Diagnosis

    May 7, 2026Xingyu Xiao, Mao Du, Jiejuan Tong +2Structured ReasoningLLM Reasoning

  13. Agentic Retrieval-Augmented Generation for Financial Document Question Answering

    May 6, 2026Yang Shu, Yingmin Liu, Zequn XieFinancial QAAgentic RAG

  14. The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models

    May 5, 2026Daniel Drucker, Kyle MahowaldLLM Self-CorrectionLLM Evaluation

  15. SERE: Structural Example Retrieval for Enhancing LLMs in Event Causality Identification

    May 5, 2026Zhifeng Hao, Zhongjie Chen, Junhao Lu +5Causal Reasoning in Language ModelsCausal Reasoning

  16. When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning

    May 5, 2026Jiaqi Wei, Xuehang Guo, Pengfei Yu +5LLM ServingLLM Reasoning

  17. Do LLMs have core beliefs?

    May 5, 2026Anna Sokol, Marianna B. Ganapini, Nitesh V. ChawlaCognitive ModelingLLM Reasoning

  18. Measuring AI Reasoning: A Guide for Researchers

    May 4, 2026Munachiso Samuel Nwadike, Zangir Iklassov, Kareem Ali +2Reasoning EvaluationLLM Reasoning

  19. The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling

    May 4, 2026Tu Nguyen, Matthieu Zimmer, Rasul Tutunov +2Language Model DecodingLLM Inference Acceleration

  20. Evaluating LLMs on Large-Scale Graph Property Estimation via Random Walks

    May 2, 2026Sunil Kumar Maurya, Xin LiuLLM EvaluationLLM Reasoning with Graphs

  21. Verbal-R3: Verbal Reranker as the Missing Bridge between Retrieval and Reasoning

    May 2, 2026Sangkwon Park, Donghun Kang, Jisoo Mok +1Retrieval-Augmented GenerationLLM Reranking

  22. Reasoning emerges from constrained inference manifolds in large language models

    May 2, 2026Yanbiao Ma, Fei Luo, Linfeng Zhang +10LLM InferenceLLM Interpretability

  23. When Less is Enough: Efficient Inference via Collaborative Reasoning

    May 1, 2026Yilei Chen, Sharut Gupta, Yannis Paschalidis +2Efficient Language Model ReasoningEfficient Language Model Inference

  24. When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models

    May 1, 2026Sailesh Panda, Pritam Kadasi, Abhishek Upperwal +1LLM EvaluationInstruction Following