Efficient Language Model Reasoning

Latest papers 166

All topics
CardsList
  1. SCOPE-RL: Optimizing Reasoning Paths Before and After Success

    Jul 13, 2026Xiaojian Liu, Han Xu, Jianqiang Xia +6Reward ShapingRL for Language Model Reasoning

  2. OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping

    Jul 13, 2026Mohammed Ehab, Aymane El Gadarri, Vivek F. Farias +2Overthinking in Language ModelsSequential Decision Making

  3. Structured Thoughts For Improved Reasoning And Context Pruning

    Jul 11, 2026Zain Sarwar, Supriyo Chakraborty, Berkcan Kapusuzoglu +5CoT ReasoningEfficient Language Model Reasoning

  4. Switch-Reasoner: Learn When to Think in Multitask Mixtures via Reinforcement Learning

    Jul 9, 2026Yiyang Fang, Pei Fu, Jinjie Li +7Efficient Multimodal InferenceRL for Language Model Reasoning

  5. Forethought: Verifiable Reasoning from Neurosymbolic Primitive Programming

    Jul 5, 2026Vishvesh Bhat, Jay Vaghasiya, Emmanuel Anaya GonzalezSymbolic ReasoningEfficient Language Model Reasoning

  6. Diffusion-GR2: Diffusion Generative Reasoning Re-ranker

    Jul 1, 2026Zhuoxuan Zhang, Kangqi Ni, Yuhang Chen +12Blockwise Diffusion Language ModelsEfficient Language Model Reasoning

  7. Message Passing Enables Efficient Reasoning

    Jul 1, 2026Xuecheng Liu, Daman Arora, Gokul Swamy +1Inference-Time ScalingEfficient Language Model Reasoning

  8. Efficient Multilingual Reasoning Transfer via Progressive Code-Switching

    Jul 1, 2026Zhijun Wang, Junxiao Liu, Hao Zhou +3Code-SwitchingCross-Lingual Reasoning in Language Models

  9. CoLT: Teaching Multi-Modal Models to Think with Chain of Latent Thoughts

    Jun 30, 2026Lianyu Hu, Shengqian Qin, Zeqin Liao +4Efficient Multimodal InferenceEfficient Language Model Reasoning

  10. Fork-Think with Confidence

    Jun 30, 2026Zena Al-Khalili, Rafi Hakim, Dietrich Klakow +1LLM Inference EfficiencyEfficient Language Model Reasoning

  11. When Does Learning to Stop Help? A Cost-Aware Study of Early Exits in Reasoning Models

    Jun 29, 2026Zhe Dong, Fang Qin, Manish ShahEarly StoppingCost-Aware Inference

  12. Why Struggle with Continuous Latents? Interpretable Discrete Latent Reasoning via Rendered Compression

    Jun 29, 2026Shuochen Chang, Qingyang Liu, Shaobo Wang +8LLM InterpretabilityEfficient Language Model Reasoning

  13. When LLMs Develop Languages: Symbolic Communication for Efficient Multi-Agent Reasoning

    Jun 28, 2026Zhengqi Pei, Qingming Huang, Shuhui WangMulti-Agent LLM SystemsEfficient Language Model Reasoning

  14. Quantization Inflates Reasoning: Token Inflation as a Hidden Cost of Low-Bit Reasoning Models

    Jun 24, 2026Xinyu Lian, Walid Krichene, Beichen Huang +4LLM Inference EfficiencyLLM Quantization

  15. Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing

    Jun 24, 2026Yutong Yin, Mingyu Jin, Jin Pan +12RL for Language Model ReasoningTest-Time Scaling

  16. SPIRAL: Learning to Search and Aggregate

    Jun 22, 2026Jubayer Ibn Hamid, Ifdita Hasan Orney, Michael Y. Li +5Reinforcement LearningRL for Language Model Reasoning

  17. Masked Self-Distillation: Internalizing the Chain-of-Thought in Language Models

    Jun 18, 2026Durgesh Kalwar, Vardhan Palod, Jaya Adithya Pavuluri +1CoT DistillationEfficient Language Model Reasoning

  18. Efficiently Representing Algorithms With Chain-of-Thought Transformers

    Jun 18, 2026Yanhong Li, Anej Svete, Ashish Sabharwal +1TransformerCoT Reasoning

  19. Entropy-Gated Latent Recursion

    Jun 15, 2026Soham Bhattacharjee, Dushyant Singh Chauhan, Salem Lahlou +2LLM InferenceInference-Time Scaling

  20. Latent Thought Flow: Efficient Latent Reasoning in Large Language Models

    Jun 15, 2026Xiandong Zou, Jing Huang, Jianshu Li +1RL for Language Model ReasoningEfficient Language Model Reasoning

  21. Beyond the Commitment Boundary: Probing Epiphenomenal Chain-of-Thought in Large Reasoning Models

    Jun 11, 2026Daniel Scalena, Sara Candussio, Luca Bortolussi +3CoT FaithfulnessLLM Interpretability

  22. Sample Where You Struggle: Sharpening Base Model Reasoning via Entropy-Guided Power Sampling

    Jun 7, 2026Hong Guo, Nianhui Guo, Christoph Meinel +1Markov Chain Monte CarloInference-Time Scaling

  23. DyCon: Dynamic Reasoning Control via Evolving Difficulty Modeling

    Jun 5, 2026Tengyao Tu, Yulin Li, Hui-Ling Zhen +6Overthinking in Language ModelsEfficient Language Model Reasoning