LLM Mathematical Reasoning

LLM: Large Language Model

Momentum

19 papers in the last four weeks, up 375% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 194

All topics
CardsList
  1. From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning

    May 21, 2026Xitai Jiang, Zihan Tang, Wenze Lin +3RL for Language Model ReasoningCredit Assignment in RL

  2. MindLoom: Composing Thought Modes for Frontier-Level Reasoning Data Synthesis

    May 20, 2026Haiyang Shen, Taian Guo, Xuanzhong Chen +11Synthetic Data GenerationStructured Reasoning

  3. Draw2Think: Harnessing Geometry Reasoning through Constraint Engine Interaction

    May 20, 2026Juncheng Hu, Jiawei Du, Xin Zhang +1Mathematical ReasoningLLM Mathematical Reasoning

  4. RMA: Context-Orchestrated Research Math Agents

    May 20, 2026Zelin Zhao, Bo Yuan, Yuchen Zhu +2LLM Context ManagementLLM Mathematical Reasoning

  5. What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code

    May 19, 2026Yuze Zhao, Junpeng Fang, Lu Yu +6Structured ReasoningLLM Code Generation

  6. Mathematical Reasoning in Large Language Models: Benchmarks, Architectures, Evaluation, and Open Challenges

    May 19, 2026Husnain Amjad, Raja Khurram Shahzad, Aamir Shahzad +1Mathematical Reasoning BenchmarksLLM Evaluation

  7. Beyond Fixed Budgets: Characterizing the Inelasticity and Limitations of Tree-of-Thought Reasoning Strategies

    May 19, 2026Atkia Mahila, Avinash Maurya, M. Mustafa Rafique +1LLM EvaluationInference-Time Search

  8. STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision

    May 19, 2026Jiaao Wu, Xian Zhang, Hanzhang Liu +3Multi-Agent OrchestrationMulti-Agent Reasoning

  9. Step-wise Rubric Rewards for LLM Reasoning

    May 17, 2026Weichu Xie, Haozhe Zhao, Wenpu Liu +15Reward ModelingCredit Assignment in RL

  10. LinAlg-Bench: A Forensic Benchmark Revealing Structural Failure Modes in LLM Mathematical Reasoning

    May 15, 2026Shradha Agarwal, Deepak Rajbhar, Tariq JMathematical Reasoning BenchmarksLLM Evaluation

  11. From LLM-Generated Conjectures to Lean Formalizations: Automated Polynomial Inequality Proving via Sum-of-Squares Certificates

    May 14, 2026Ruobing Zuo, Hanrui Zhao, Gaolei He +2Mathematical ReasoningNeuro-Symbolic Reasoning

  12. Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling

    May 13, 2026Yafu Li, Runzhe Zhan, Haoran Zhang +25RL for Language Model ReasoningLLM Mathematical Reasoning

  13. Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning

    May 12, 2026Zhaomeng Zhou, Lan Zhang, Junyang Wang +2RL for Language Model ReasoningEfficient Language Model Reasoning

  14. Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information

    May 12, 2026Guobin Shen, Xiang Cheng, Chenxiao Zhao +4On-Policy Self-DistillationRL for Language Model Reasoning

  15. Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness

    May 11, 2026Ivo Petrov, Jasper Dekoninck, Dimitar I. Dimitrov +1Mathematical Reasoning BenchmarksLLM Evaluation

  16. M2A: Synergizing Mathematical and Agentic Reasoning in Large Language Models

    May 11, 2026Junjian Wang, Xin Zhou, Qiran Xu +1Software Engineering AgentsAgentic Reasoning

  17. Beyond Accuracy: Evaluating Strategy Diversity in LLM Mathematical Reasoning

    May 10, 2026Xia Yang, Xuanyi Zhang, Hao Hu +1Mathematical Reasoning BenchmarksLLM Evaluation

  18. Teaching Language Models to Think in Code

    May 8, 2026Hyeon Hwang, Jiwoo Lee, Jaewoo KangNumerical Reasoning in Language ModelsLLM Mathematical Reasoning

  19. Verifier-Backed Hard Problem Generation for Mathematical Reasoning

    May 7, 2026Yuhang Lai, Jiazhan Feng, Yee Whye Teh +1Reinforcement Learning with Verifiable RewardsMulti-Agent LLMs

  20. Shortcut Solutions Learned by Transformers Impair Continual Compositional Reasoning

    May 6, 2026William T. Redman, Erik C. Johnson, Brian RobinsonCompositional ReasoningContinual Learning