Mathematical Reasoning

Momentum

17 papers in the last four weeks, against 2 the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 113

All topics
CardsList
  1. IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning

    Apr 27, 2026Navya Gupta, Rishitej Reddy Vyalla, Avinash Anand +8Cross-Lingual Reasoning in Language ModelsRL for Language Model Reasoning

  2. OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model

    Apr 22, 2026Qiguang Chen, Chengyu Luan, Jiajun Wu +7VLM EvaluationVisual Reasoning

  3. HiPO: Hierarchical Preference Optimization for Adaptive Reasoning in LLMs

    Apr 22, 2026Darsh Kachroo, Arjun Prasaath Anbazhagan, Adriana Caraeni +2LLM AlignmentDirect Preference Optimization

  4. How Do Answer Tokens Read Reasoning Traces? Self-Reading Patterns in Thinking LLMs for Quantitative Reasoning

    Apr 21, 2026Haoyang Chen, Yi Liu, Jianzhi Shao +3LLM InterpretabilityMathematical Reasoning

  5. Probabilistic Programs of Thought

    Apr 19, 2026Poorva Garg, Renato Lui Geh, Daniel Israel +3LLM-Based Program SynthesisEfficient Language Model Reasoning

  6. DenTab: A Dataset for Table Recognition and Visual QA on Real-World Dental Estimates

    Apr 17, 2026Laziz Hamdi, Amine Tamasna, Thierry PaquetTable QATable Structure Recognition

  7. Correct Prediction, Wrong Steps? Consensus Reasoning Knowledge Graph for Robust Chain-of-Thought Synthesis

    Apr 15, 2026Zipeng Ling, Shuliang Liu, Seonil Son +4Logical ReasoningSelf-Consistency Decoding

  8. BRIDGE: Bridging Reasoning In Distillation Gap Elimination via Structure-Aware Masking

    Feb 5, 2026Bowen Yu, Sheng Zhang, Binhao Wang +8CoT DistillationMathematical Reasoning

  9. ProofVerifier: A Scalable, Diversity-Driven Framework for Natural-Language Proof Verification

    Feb 2, 2026Haotong Yang, Zitong Wang, Shijia Kang +7Synthetic Data GenerationMathematical Reasoning

  10. ConPress: Learning Efficient Reasoning from Multi-Question Contextual Pressure

    Feb 1, 2026Jie Deng, Shining Liang, Jun Li +2Efficient Language Model ReasoningLLM Inference Acceleration

  11. Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability

    Jan 26, 2026Shobhita Sundaram, John Quan, Ariel Kwiatkowski +3Self-Play RLRL for Language Model Reasoning

  12. DAGGER: Distractor-Aware Graph Generation for Executable Reasoning in Math Problems

    Jan 11, 2026Zabir Al Nazi, Shubhashis Roy Dipta, Sudipta KarNumerical Reasoning in Language ModelsMathematical Reasoning Benchmarks

  13. Stepwise Think-Critique: Interleaved Reasoning and Self-Critique in a Single LLM

    Dec 17, 2025Jiaqi Xu, Cuiling Lan, Xuejin Chen +1LLM Self-CorrectionCoT Reasoning

  14. A Model Can Help Itself: Reward-Free Self-Training for LLM Reasoning

    Oct 21, 2025Mengqi Li, Lei Zhao, Anthony Man-Cho So +2Self-Training for Language ModelsMathematical Reasoning

  15. StatEval: A Comprehensive Benchmark for Large Language Models in Statistics

    Oct 10, 2025Yuchen Lu, Run Yang, Yichen Zhang +6LLM EvaluationReasoning Evaluation

  16. An Investigation of Robustness of LLMs in Mathematical Reasoning: Benchmarking with Mathematically-Equivalent Transformation of Advanced Mathematical Problems

    Aug 12, 2025Yuren Hao, Xiang Wan, ChengXiang ZhaiMathematical ReasoningLLM Mathematical Reasoning

  17. AI Mathematician: Towards Fully Automated Frontier Mathematical Research

    May 28, 2025Yuanhang Liu, Yanxing Huang, Yanqiao Wang +2AI-Assisted Scientific ResearchMathematical Reasoning

  18. Efficient Reinforcement Finetuning via Adaptive Curriculum Learning

    Apr 7, 2025Taiwei Shi, Yiyang Wu, Linxin Song +2RL for Language Model ReasoningMathematical Reasoning