Efficient Language Model Reasoning

Latest papers 166

All topics
CardsList
  1. Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning

    May 12, 2026Zhaomeng Zhou, Lan Zhang, Junyang Wang +2RL for Language Model ReasoningEfficient Language Model Reasoning

  2. LEAD: Length-Efficient Adaptive and Dynamic Reasoning for Large Language Models

    May 10, 2026Songtao Wei, Yi Li, Zhikai Li +7RL for Language Model ReasoningEfficient Language Model Reasoning

  3. Efficient LLM Reasoning via Variational Posterior Guidance with Efficiency Awareness

    May 10, 2026Zizhao Chen, Yuying Li, Siting Lin +1LLM Inference EfficiencyEfficient Language Model Reasoning

  4. Hint Tuning: Less Data Makes Better Reasoners

    May 9, 2026Siqi Fan, Minghao Li, Xiaoqian Ma +6Overthinking in Language ModelsLLM Fine-Tuning

  5. ExpThink: Experience-Guided Reinforcement Learning for Adaptive Chain-of-Thought Compression

    May 8, 2026Tingcheng Bian, Yuzhe Zhang, Jing Jin +5Reward ShapingRL for Language Model Reasoning

  6. Confidence-Aware Alignment Makes Reasoning LLMs More Reliable

    May 8, 2026Kejia Chen, Jiawen Zhang, Yihong Wu +5LLM AlignmentDirect Preference Optimization

  7. LaTER: Efficient Test-Time Reasoning via Latent Exploration and Explicit Verification

    May 8, 2026Xuan Li, Yining Wang, Yuchen Liu +7CoT ReasoningEfficient Language Model Reasoning

  8. Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learning

    May 7, 2026Ömer Faruk Akgül, Rajgopal Kannan, Willie Neiswanger +1RL for Language Model ReasoningEfficient Language Model Reasoning

  9. Policy-Guided Stepwise Model Routing for Cost-Effective Reasoning

    May 7, 2026Wenwen Si, Insup Lee, Osbert BastaniCost-Aware InferenceEfficient Language Model Reasoning

  10. ZAYA1-8B Technical Report

    May 6, 2026Robert Washbourne, Rishi Iyer, Tomas Figliolia +15Mixture-of-Experts Language ModelsRL for Language Model Reasoning

  11. Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling

    May 2, 2026Florian Valentin Wunderlich, Lars Benedikt Kaesberg, Jan Philip Wahle +2Self-Consistency DecodingCost-Aware Inference

  12. When Less is Enough: Efficient Inference via Collaborative Reasoning

    May 1, 2026Yilei Chen, Sharut Gupta, Yannis Paschalidis +2Efficient Language Model ReasoningEfficient Language Model Inference

  13. Select to Think: Unlocking SLM Potential with Local Sufficiency

    Apr 29, 2026Wenxuan Ye, Yangyang Zhang, Xueli An +2Small Language ModelsEfficient Language Model Reasoning

  14. Dual-Track CoT: Budget-Aware Stepwise Guidance for Small LMs

    Apr 27, 2026Sagnik Chatterjee, Atharva Patil, Sricharan RameshCoT ReasoningSmall Language Models

  15. Stabilizing Efficient Reasoning with Step-Level Advantage Selection

    Apr 27, 2026Han Wang, Xiaodong Yu, Jialian Wu +4RL for Language Model ReasoningEfficient Language Model Reasoning

  16. Tandem: Riding Together with Large and Small Language Models for Efficient Reasoning

    Apr 26, 2026Zichuan Fu, Xian Wu, Guojing Li +7Efficient Language Model ReasoningLLM Inference Acceleration

  17. Large Language Models Decide Early and Explain Later

    Apr 24, 2026Ayan Datta, Zhixue Zhao, Bhuvanesh Verma +3Efficient Language Model ReasoningLLM Inference Acceleration

  18. Thinking with Reasoning Skills: Fewer Tokens, More Accuracy

    Apr 23, 2026Guangxiang Zhao, Qilong Shi, Xusen Xiao +3Efficient Language Model ReasoningEfficient Language Model Inference

  19. TRACES: Tagging Reasoning Steps for Adaptive Cost-Efficient Early-Stopping

    Apr 22, 2026Yannis Belkhiter, Seshu Tirupathi, Giulio Zizzo +1LLM Inference EfficiencyEarly Stopping

  20. Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework

    Apr 22, 2026Chenyuan Zhang, Qiguang Chen, Xie Chen +6Cross-Lingual Reasoning in Language ModelsCoT Reasoning

  21. How Much Thinking is Enough? Quantifying and Understanding Redundancy in LLM Reasoning

    Apr 21, 2026Zhiyuan Zhai, Xinkai You, Wenjing Yan +1LLM Inference EfficiencyRL for Language Model Reasoning

  22. Neural Garbage Collection: Learning to Forget while Learning to Reason

    Apr 20, 2026Michael Y. Li, Jubayer Ibn Hamid, Emily B. Fox +1LLM CompressionMemory-Efficient Optimization

  23. Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning

    Apr 19, 2026Raman Saparkhan, Majd Hawasly, Md Rizwan Parvez +1LLM Inference EfficiencySelf-Consistency Decoding

  24. Probabilistic Programs of Thought

    Apr 19, 2026Poorva Garg, Renato Lui Geh, Daniel Israel +3LLM-Based Program SynthesisEfficient Language Model Reasoning

  25. TrigReason: Trigger-Based Collaboration between Small and Large Reasoning Models

    Apr 16, 2026Yi Zhao, Yajuan Peng, Cam-Tu Nguyen +4Efficient Language Model ReasoningLLM Inference Acceleration