Numerical Reasoning in Language Models

Latest papers 73

All topics
CardsList
  1. COMPASS: Finding Where Reasoning Lives in Language Models

    Oct 5, 2026Pratyay Dutta, Kowshik Thopalli, Vivek NarayanaswamyEfficient Language Model ReasoningActivation Steering

  2. Sharpen Without Search: On-Policy Distillation of Sequence-Level Power Distribution

    Oct 5, 2026Erfan Baghaei Potraghloo, Seyedarmin Azizi, Arya Fayyazi +4Numerical Reasoning in Language ModelsEfficient Language Model Reasoning

  3. Towards Robust Numerical Claim Verification

    Sep 30, 2026Peter Røysland Aarnes, Vinay SettyNumerical Reasoning in Language ModelsClaim Verification

  4. When the Right Answer Is Missing: An Arithmetic-Dependent Rejection Bottleneck in Jev

    Sep 30, 2026Jike Zhong, Ming Li, Yuxiang LaiNumerical Reasoning in Language ModelsSelective Prediction

  5. Targeted Retrieval, Compact Representations: How CoT Reasoning Improves Long-Context Counting

    Sep 30, 2026Liang Twist Shan, Tianyu Hu, Hao Yan +1Numerical Reasoning in Language ModelsLong-Context Retrieval

  6. Reasoning Externalization for Faithful Large Language Model Narratives of Stock Return Predictions

    Sep 30, 2026Sujung Kim, Seung Hwan Cho, Sangjin Park +1Numerical Reasoning in Language ModelsFaithfulness of Language Model Explanations

  7. Activation-Conditioned Self-Distillation

    Sep 29, 2026Zhexi Lu, Subhajit Chaudhury, Tejaswini Pedapati +2Numerical Reasoning in Language ModelsOn-Policy Self-Distillation

  8. When Models Don't Manipulate Manifolds: The Geometry of a Comparison Task

    Sep 29, 2026Sai Sumedh R. Hindupur, Hadas Orgad, Thomas Fel +1Numerical Reasoning in Language ModelsMechanistic Interpretability

  9. Reasoning with Continuous Latent Diffusion

    Sep 28, 2026Xiang ChengNumerical Reasoning in Language ModelsCode Generation

  10. When Harness Beats Scale, and When Reading Beats Both

    Sep 28, 2026Ivan Bondarenko, Nikolay O. NikitinNumerical Reasoning in Language ModelsLanguage Model Scaling

  11. Next Thoughts Are Distributions: Generative Autoregressive Reasoning in the Latent Space

    Sep 27, 2026Yang Li, Yi Wang, Shiyuan Huang +3Numerical Reasoning in Language ModelsContinuous Latent Reasoning

  12. Teach Yourself Where to Look: On-Policy Attention Self-Distillation for Reasoning

    Sep 27, 2026Safaeid Hossain Arib, Rabeya Akter, Ismam Nur Swapnil +3Numerical Reasoning in Language ModelsOn-Policy Self-Distillation

  13. Ladders of Thought: A Self-Evolving Curriculum of Progressively Simplified Reasoning Traces

    Sep 22, 2026Minghui Liu, Thomas Magelinski, Dehao Yuan +2Numerical Reasoning in Language ModelsCurriculum Learning

  14. Voice of Reason: Reinforcement Learning for Spoken Math

    Sep 16, 2026Timothée Weisselberger, Edouard Graves, Alexandre DéfossezNumerical Reasoning in Language ModelsRL for Language Model Reasoning

  15. Language Is an Insufficient Substrate for Quantitative Reasoning, and Consequential Domains Need Large Quantitative Models

    Sep 14, 2026Reuben Vandeventer, David Imrem, David J. WildNumerical Reasoning in Language ModelsLLM Reliability

  16. Towards a Deterministic Math Solver for Clinical Language Models

    Sep 12, 2026Felipe Ocampo Osorio, Sebastián Andrés Cajas Ordoñez, Maximin Lange +5Numerical Reasoning in Language ModelsLLM Reliability

  17. CircuitLens: Reasoning Circuits as Data Selection Signals for Reinforcement Learning with Verifiable Rewards

    Sep 7, 2026Zhuofan Chen, Ziqian Jiao, Yikai Cui +3Numerical Reasoning in Language ModelsReinforcement Learning

  18. When Financial Fine-tuning Fails: A Three-Level Detectability Analysis of Numerical Hallucination in Domain-Adapted Language Models

    Sep 7, 2026Xiaodong Li, Peiwei LiuNumerical Reasoning in Language ModelsHallucination in Language Models

  19. Lost in Reordering: Structural Sensitivity of Multilingual LLMs under Semantics-Preserving Perturbations

    Sep 3, 2026Karthika Nhayakkat, Rajat Verma, Maharaj Brahma +4Numerical Reasoning in Language ModelsMultilingual Language Model Evaluation

  20. Gradients Know What Outcomes Don't: Unlocking Reinforcement Learning for LLM Reasoning with Gradient-Aligned Rewards

    Sep 3, 2026Leqi Zheng, Jinbo Su, Fang Niu +8Numerical Reasoning in Language ModelsReward Shaping

  21. Numeracy in Large Language Models: Fundamental Limitations and Paths to Improvement

    Aug 13, 2026Aoxin NiNumerical Reasoning in Language ModelsLLM Grounding