Efficient Language Model Reasoning

Latest papers 166

All topics
CardsList
  1. Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models

    Sep 22, 2026Xiaoyu Luo, Tao Ren, Wenrui Yu +3LLM InterpretabilityCoT Reasoning

  2. Rollout Efficiency in Reinforcement Learning for Reasoning Large Language Models: A Taxonomy and Future Directions

    Sep 21, 2026Niloofar Gholipour, Marcos Assuncao, Gursimran Singh +8LLM Inference EfficiencyReinforcement Learning

  3. When2Think: Learning When and How Much to Reason

    Sep 17, 2026Jaejun Shim, HyunJin Kim, Young Jin Kim +1Overthinking in Language ModelsRL for Language Model Reasoning

  4. Efficient Reasoning Distillation: Small Video-Language Models via Synthetic CoT and Difficulty-Aware Fine-Tuning

    Sep 14, 2026Mantek Singh, Jeshwanth Challagundla, Siddharth Raina +1CoT DistillationVLM Distillation

  5. Self-Orchestrating Language Models: Leveraging Semantic Dependence for Efficient Inference

    Sep 13, 2026Tian JinLong-Context Language Model InferenceEfficient Language Model Reasoning

  6. RetroThinker: Enabling Retrospective Thinking in Speech LLMs

    Sep 12, 2026Yi-Jen Shih, Puyuan Peng, Abdelrahman Mohamed +1LLM Self-CorrectionEfficient Language Model Reasoning

  7. A*-Thought-V2: Efficient Latent Reasoning via Geometric Dynamics of LLM

    Sep 7, 2026Xiaoang Xu, Siyuan Liu, Shuo Wang +13Efficient Language Model ReasoningContinuous Latent Reasoning

  8. </think> Doesn't Stop Reasoning: Analysis of Spurious CoT Termination

    Sep 3, 2026Seunghee Koh, Sungjae Choi, Minchan Kwon +2CoT ReasoningEfficient Language Model Reasoning

  9. Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning

    Sep 3, 2026Heng Wang, Jielin Qiu, Wenting Zhao +8KV CachingMemory-Efficient Optimization

  10. A Model with No Head and Many Thoughts

    Aug 31, 2026Nikita Koriagin, Yaroslav Aksenov, George Bredis +3Efficient Language Model ReasoningLLM Inference Acceleration

  11. HSRM: Hidden-State Reward Models for Test-Time Verification

    Aug 31, 2026Xianzhi Li, Xiaodan ZhuLLM Answer VerificationEfficient Language Model Reasoning

  12. ERR+: Sequential Entropy Resolution for Efficient and Decisive LLM Reasoning

    Aug 28, 2026Xin Jiang, Minhao Wang, Wen Wu +4Reward ShapingRL for Language Model Reasoning

  13. BDH-CQ: In-Context Learning with Recurrent Latent Reasoning

    Aug 10, 2026Björn Engdahl, Adrian Kosowski, Jan Chorowski +6Cost-Aware InferenceEfficient Language Model Reasoning

  14. Thought-Level Beam Search for Reasoning

    Aug 8, 2026Lijie Yang, Hongyin Luo, Jiawei Zhao +2Inference-Time SearchEfficient Language Model Reasoning

  15. Fewer Tokens, Smaller Cache: Reward-Coordinated Efficient Reasoning

    Aug 5, 2026Qiyuan Zhu, Dezhi Li, Pengyu Cheng +8Overthinking in Language ModelsKV Caching

  16. Interpretable Adaptive Sampling for LLM Test-Time Scaling

    Aug 4, 2026Mobina Kashaniyan, Ali JannesariLLM Inference EfficiencyTest-Time Scaling

  17. Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces

    Aug 4, 2026Francesca Carlon, Vincent Ginis, Andres AlgabaLLM EvaluationOverthinking in Language Models

  18. BLADE: Boundary-Expanded and Layer-Adaptive Dynamic Exit for Efficient LLM Reasoning

    Jul 31, 2026Keshu Fu, Keqin Peng, Jun Bai +6Efficient Language Model ReasoningEfficient Language Model Inference

  19. QLPO: Quadrant-weighted Sampling for Length-aware Policy Optimization

    Jul 23, 2026Siwei Chen, Siqi Chen, Xupeng Miao +1Overthinking in Language ModelsRL for Language Model Reasoning

  20. Efficient Chain-of-Modality Reasoning via Progressive Compression for Spoken Language Models

    Jul 22, 2026Pengchao Feng, Chao-Hong Tan, Qian Chen +3Efficient Language Model ReasoningSpeech Language Models

  21. The Price of Reasoning: Cost-Quality Tradeoffs in Reinforcement Learning for Neural Machine Translation

    Jul 21, 2026Michael Jungo, Aixiu AnRL for Language ModelsRL for Language Model Reasoning

  22. MADA-RL: Multi-Agent Debate-Aware Reinforcement Learning for Parameter-Efficient Reasoning in Compact Models

    Jul 20, 2026Martino M. L. Pulici, Cuong Xuan Chu, Evgeny Kharlamov +3RL for Language Model ReasoningMulti-Agent Debate

  23. Better Starts, Better Ends: Bootstrapped Iterative Self-Reasoning Distillation for Compressed Reasoning

    Jul 17, 2026Leichao Dong, Dongxu Zhang, Yiding Sun +4CoT DistillationEfficient Language Model Reasoning