Mathematical Reasoning

Momentum

17 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 113

All topics
CardsList
  1. AIMO Interpretability Challenge

    Jul 15, 2026Michal Štefánik, Philipp Mondorf, Andreas Waldis +11Mathematical Reasoning BenchmarksLLM Interpretability

  2. PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages

    Jul 7, 2026Daryna Dementieva, Nikolay Babakov, Kathy Hämmerl +14Mathematical Reasoning BenchmarksMultilingual Language Model Evaluation

  3. Why Pure Reasoning is Not Enough: Nature as the Source of Mathematical Innovation

    Jul 5, 2026Charanjit S. Jutla, Vimal SharmaAnalogical ReasoningMathematical Reasoning

  4. ISM:Self-Improving Strategy Memory for Continual Mathematical Reasoning

    Jun 30, 2026Prakhar Dixit, Tim OatesContinual Learning for LLMsMemory-Augmented Language Models

  5. Knowledge Distillation from Large Reasoning Models to Compact Student Models: A Case Study on the John O Bryan Mathematics Competition

    Jun 30, 2026Gaurab Baral, Aaditya Khanal, Yangyang Tao +1CoT DistillationMathematical Reasoning

  6. LatentRevise: Learning from Zero-Hit Reasoning

    Jun 29, 2026Yiqiu Guo, Xueting Han, Qi Jia +2RL for Language Model ReasoningMathematical Reasoning

  7. AIR: Adaptive Interleaved Reasoning with Code in MLLMs

    Jun 22, 2026Cong Han, Xiaohan Lan, Haibo Qiu +1Multimodal Large Language ModelsMathematical Reasoning

  8. VeriEvol: Scaling Multimodal Mathematical Reasoning via Verifiable Evol-Instruct

    Jun 22, 2026Haoling Li, Kai Zheng, Jie Wu +4Multimodal ReasoningMathematical Reasoning

  9. The Correct Answer Trap: Pedagogically-Grounded Detection and Feedback for Hidden Misconceptions

    Jun 22, 2026Moiz Imran, Sahan BulathwelaIntelligent Tutoring SystemsEducational Assessment

  10. Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts

    Jun 20, 2026Qingfei Zhao, Huan Song, Shuyu Tian +2Trajectory GenerationCoT Distillation

  11. ExpRL: Exploratory RL for LLM Mid-Training

    Jun 15, 2026Violet Xiang, Amrith Setlur, Chase Blagden +2Reinforcement LearningRL for Language Model Reasoning

  12. Flood and Harvest: The Provable Necessity of Trivia for Generating Valuable Mathematics via the Lens of Language Generation in the Limit

    Jun 12, 2026Xiaoyu Li, Andi Han, Dai Shi +3Mathematical Reasoning

  13. SuperThoughts: Reasoning Tokens in Superposition

    Jun 11, 2026Zheyang Xiong, Shivam Garg, Max Yu +4Multi-Token PredictionLLM Inference Acceleration

  14. Learning to Reason by Analogy via Retrieval-Augmented Reinforcement Fine-Tuning

    Jun 11, 2026Zilin Xiao, Qi Ma, Chun-cheng Jason Chen +4Analogical ReasoningRL for Language Model Reasoning

  15. The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes

    Jun 9, 2026Avinash Anand, Mahisha Ramesh, Avni Mittal +7CoT ReasoningRL for Language Model Reasoning

  16. ComBench: A Benchmark for Rigorous Proof Reasoning and Constructive Realization in Olympiad-Level Combinatorics

    Jun 9, 2026Shunkai Zhang, Haoran Zhang, Yun Luo +15Mathematical Reasoning BenchmarksBenchmark Design

  17. Momentum for Reasoning: Dense Intrinsic Signals in Policy Optimization

    Jun 7, 2026Hao Chen, Zhanming Shen, Liyao Li +8Intrinsic Reward MethodsReinforcement Learning

  18. Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery

    Jun 7, 2026Syed Rifat Raiyan, Mohsinul Kabir, Hasan Mahmud +2Mathematical Reasoning BenchmarksAutomated Theorem Proving

  19. CATPO: Critique-Augmented Tree Policy Optimization

    Jun 6, 2026Ayush Singh, Umang Goyal, Ankur DahiyaRL for Language ModelsReinforcement Learning

  20. LoRi: Low-Rank Distillation for Implicit Reasoning

    Jun 3, 2026Ryan Solgi, Jiayi Tian, Zheng ZhangCoT DistillationMathematical Reasoning

  21. Imbuing Large Language Models with Bidirectional Logic for Robust Chain Repair

    Jun 3, 2026Zehua Cheng, Wei Dai, Jiahao Sun +1LLM Self-CorrectionSymbolic Reasoning

  22. BiNSGPS: Geometry Problem Solving via Bidirectional Neuro-Symbolic Interaction

    Jun 3, 2026Qi Wang, Peijie Wang, Fei Yin +1Mathematical ReasoningNeuro-Symbolic Reasoning

  23. TD-Grokking: Learning from Zero-Reward Problems by Training-Time Decomposition

    Jun 3, 2026Ningyuan Xi, Hao Xu, Hongsheng Xin +1RL for Language Model ReasoningMathematical Reasoning

  24. VAMPS: Visual-Assisted Mathematical Problem Solving Benchmark

    Jun 2, 2026Amirhossein Dabiriaghdam, Shayan Vassef, Mohammadreza Bakhtiari +5Mathematical Reasoning BenchmarksMathematical Reasoning