Efficient Language Model Reasoning

Latest papers 166

All topics
CardsList
  1. Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning

    Jun 2, 2026Yu Xia, Zhouhang Xie, Xin Xu +4Language Model SteeringCoT Reasoning

  2. HybridThinker: Efficient Chain-of-Thought Reasoning via Compressed Memory and Transient Thought Steps

    Jun 2, 2026Xin Liu, Runsong Zhao, Xinyu Liu +8Memory-Augmented Language ModelsEfficient Language Model Reasoning

  3. ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning

    Jun 2, 2026Ziyan Liu, Xueda Shen, Yuzhe Gu +7Efficient Language Model ReasoningPreference Optimization

  4. Geometric Latent Reasoning Induces Shorter Generations in LLMs

    Jun 1, 2026Shashi Kumar, Yacouba Kaloga, Petr Motlicek +2Efficient Language Model ReasoningContinuous Latent Reasoning

  5. Extreme Low-Bit Inference in Reasoning Models: Failure Modes and Targeted Recovery

    Jun 1, 2026Ekaterina Alimaskina, Darya Rudas, Denis Shveykin +3LLM QuantizationEfficient Language Model Reasoning

  6. Thinking Economically: A Hierarchical Framework for Adaptive-Complexity Reasoning in LLMs

    May 31, 2026Yubo Gao, Haotian Wu, Hong Chen +8LLM Inference EfficiencyCoT Reasoning

  7. Quantized Reasoning Models Think They Need to Think Longer, but They Do Not

    May 29, 2026Sanae Lotfi, Polina Kirichenko, Steven Li +1Overthinking in Language ModelsCoT Reasoning

  8. Unlocking the Working Memory of Large Language Models for Latent Reasoning

    May 28, 2026Lukas Aichberger, Sepp HochreiterMemory-Augmented Language ModelsEfficient Language Model Reasoning

  9. Reasoning with Sampling: Cutting at Decision Points

    May 28, 2026Felix Zhou, Anay Mehrotra, Quanquan C. LiuMarkov Chain Monte CarloEfficient Language Model Reasoning

  10. ESPO: Early-Stopping Proximal Policy Optimization

    May 28, 2026Zihang Li, Rui Zhou, Yingcheng Shi +8Early StoppingReinforcement Learning

  11. Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies

    May 28, 2026Yuxuan Ye, Raul Santos-Rodriguez, Edwin SimpsonLLM GroundingClaim Verification

  12. CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

    May 27, 2026Linas Nasvytis, Simon Jerome Han, Ben Prystawski +3LLM Self-RefinementEfficient Language Model Reasoning

  13. CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models

    May 27, 2026Yukyung Lee, Yumeng Shen, Jinhyeong Park +2CoT ReasoningEfficient Language Model Reasoning

  14. Self-Consistency via Marginal Sharpening

    May 27, 2026Aleksei Arzhantsev, Otmane Sakhi, Nicolas ChopinEfficient Language Model ReasoningReasoning Consistency in Language Models

  15. Uncertainty-Aware Budget Allocation for Adaptive Test-Time Reasoning

    May 26, 2026Manh Nguyen, Sunil Gupta, Hung LeEfficient Language Model ReasoningAdaptive Sampling

  16. Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains

    May 25, 2026Hui Xie, Jie Liu, Ziyue Qiao +1Efficient Language Model ReasoningLLM Inference Acceleration

  17. Learning to Reason Efficiently with A* Post-Training

    May 23, 2026Andreas Opedal, Francesco Ignazio Re, Abulhair Saparov +3Process Reward ModelsRL for Language Model Reasoning

  18. HyperGuide: Hyperbolic Guidance for Efficient Multi-Step Reasoning in Large Language Models

    May 22, 2026Yuyu Liu, Haotian Xu, Yanan He +3LLM Fine-TuningEfficient Language Model Reasoning

  19. PathCal: State-Aware Reflection-Marker Calibration for Efficient Reasoning

    May 21, 2026Lingyu Jiang, Zirui Li, Shuo Xing +6Efficient Language Model ReasoningEfficient Language Model Inference

  20. CLORE: Content-Level Optimization for Reasoning Efficiency

    May 21, 2026Yuyang Wu, Qiyao Xue, Guanxing Lu +4RL for Language Model ReasoningEfficient Language Model Reasoning

  21. When Do LLMs Reason? A Dynamical Systems View via Entropy Phase Transitions

    May 20, 2026Wei Xia, Haoqing Wang, Zhi-Hong Deng +1Language Model DecodingCoT Reasoning

  22. Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models

    May 17, 2026Dehai Min, Giovanni Vaccarino, Huiyi Chen +3Early StoppingCoT Reasoning

  23. Reasoning Can Be Restored by Correcting a Few Decision Tokens

    May 16, 2026Changshuo Shen, Leheng Sheng, Yuxin Chen +2Efficient Language Model ReasoningInference-Time Compute Allocation

  24. CAPS: Cascaded Adaptive Pairwise Selection for Efficient Parallel Reasoning

    May 15, 2026Fangzhou Lin, Shuo Xing, Peiran Li +6Pairwise ComparisonPairwise Preference Evaluation

  25. Distribution Corrected Offline Data Distillation for Large Language Models

    May 13, 2026Yumeng Zhang, Zhengbang Yang, Yevin Nikhel Goonatilake +1CoT DistillationEfficient Language Model Reasoning

  26. Enhanced and Efficient Reasoning in Large Learning Models

    May 13, 2026Leslie G. ValiantRepresentation LearningWorld Models

  27. STOP: Structured On-Policy Pruning of Long-Form Reasoning in Low-Data Regimes

    May 13, 2026Chenjun Xu, Zhennan Zhou, Zhan Su +3LLM PruningLLM Fine-Tuning