LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. SCRuB: Social Concept Reasoning under Rubric-Based Evaluation

    May 7, 2026Jamelle Watson-Daniels, Himaghna Bhattacharjee, Skyler Wang +11LLM EvaluationRubric-Based Evaluation

  2. Measuring Black-Box Confidence via Reasoning Trajectories: Geometry, Coverage, and Verbalization

    May 7, 2026Marc Boubnovski Martell, Josefa Lia Stoisser, Kaspar Märtens +4Confidence Estimation in Language ModelsCoT Reasoning

  3. Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning

    May 7, 2026Ömer Faruk Akgül, Rajgopal Kannan, Willie Neiswanger +1RL for Language Model ReasoningEfficient Language Model Reasoning

  4. Post-Reasoning: Improving the Performance of Non-Thinking Models at No Cost

    May 7, 2026Richmond Sin Jing Xuan, Rishabh Bhardwaj, Soujanya PoriaLLM PromptingLanguage Model Post-Training

  5. Logic-Regularized Verifier Elicits Reasoning from LLMs

    May 7, 2026Xinyu Wang, Changzhi Sun, Lian Cheng +4LLM EvaluationLLM Answer Verification

  6. Hypothesis generation and updating in large language models

    May 7, 2026Hua-Dong XiongLogical ReasoningBayesian Inference

  7. Formalizing Latent Thoughts: Four Axioms of Thought Representation in LLMs

    May 7, 2026Fahd Seddik, Fatemeh FardLLM EvaluationLLM Interpretability

  8. G-SHARE: A Guideline-Based Structured Reasoning Framework for Human-Factor Event Diagnosis

    May 7, 2026Xingyu Xiao, Mao Du, Jiejuan Tong +2Structured ReasoningLLM Reasoning

  9. Agentic Retrieval-Augmented Generation for Financial Document Question Answering

    May 6, 2026Yang Shu, Yingmin Liu, Zequn XieFinancial QAAgentic RAG

  10. The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models

    May 5, 2026Daniel Drucker, Kyle MahowaldLLM Self-CorrectionLLM Evaluation

  11. SERE: Structural Example Retrieval for Enhancing LLMs in Event Causality Identification

    May 5, 2026Zhifeng Hao, Zhongjie Chen, Junhao Lu +5Causal Reasoning in Language ModelsCausal Reasoning

  12. When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning

    May 5, 2026Jiaqi Wei, Xuehang Guo, Pengfei Yu +5LLM ServingLLM Reasoning

  13. Do LLMs have core beliefs?

    May 5, 2026Anna Sokol, Marianna B. Ganapini, Nitesh V. ChawlaCognitive ModelingLLM Reasoning

  14. Measuring AI Reasoning: A Guide for Researchers

    May 4, 2026Munachiso Samuel Nwadike, Zangir Iklassov, Kareem Ali +2Reasoning EvaluationLLM Reasoning

  15. The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling

    May 4, 2026Tu Nguyen, Matthieu Zimmer, Rasul Tutunov +2Language Model DecodingLLM Inference Acceleration

  16. Evaluating LLMs on Large-Scale Graph Property Estimation via Random Walks

    May 2, 2026Sunil Kumar Maurya, Xin LiuLLM EvaluationLLM Reasoning with Graphs

  17. Verbal-R3: Verbal Reranker as the Missing Bridge between Retrieval and Reasoning

    May 2, 2026Sangkwon Park, Donghun Kang, Jisoo Mok +1Retrieval-Augmented GenerationLLM Reranking

  18. Reasoning emerges from constrained inference manifolds in large language models

    May 2, 2026Yanbiao Ma, Fei Luo, Linfeng Zhang +10LLM InferenceLLM Interpretability

  19. When Less is Enough: Efficient Inference via Collaborative Reasoning

    May 1, 2026Yilei Chen, Sharut Gupta, Yannis Paschalidis +2Efficient Language Model ReasoningEfficient Language Model Inference

  20. When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models

    May 1, 2026Sailesh Panda, Pritam Kadasi, Abhishek Upperwal +1LLM EvaluationInstruction Following

  21. Decouple before Integration: Test-time Synthesis of SFT and RLVR Task Vectors

    May 1, 2026Chaohao Yuan, Chenghao Xiao, Yu Rong +2Task ArithmeticLanguage Model Merging

  22. Impact of Task Phrasing on Presumptions in Large Language Models

    May 1, 2026Kenneth J. K. OngPrompt SensitivityLLM Prompting

  23. Assert, don't describe: Linguistic features that shift LLM reasoning about animal welfare

    Apr 30, 2026Jasmine Brazilek, Harper DunnMoral Reasoning in Language ModelsLanguage Model Post-Training

  24. Retrieval-Augmented Reasoning for Chartered Accountancy

    Apr 30, 2026Jatin Gupta, Akhil Sharma, Saransh Singhania +1Retrieval-Augmented GenerationFinancial QA