LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. rePIRL: Learn PRM with Inverse RL for LLM Reasoning

    Feb 8, 2026Xian Wu, Kaijie Zhu, Ying Zhang +2Reinforcement LearningProcess Reward Models

  2. GR2: Generative Reasoning Re-ranker

    Feb 8, 2026Mingfu Liang, Yufei Li, Jay Xu +20RL for Language ModelsLLM Reranking

  3. Bypassing the Rationale: Causal Auditing of Implicit Reasoning in Language Models

    Feb 3, 2026Anish Sathyanarayanan, Aditya Nagarsekar, Aarush RathoreCoT FaithfulnessFaithfulness of Language Model Explanations

  4. Uncertainty Localization in LLM Reasoning via Embedding Perturbations

    Feb 2, 2026Qihao Wen, Jiahao Wang, Yang Nan +3LLM ReliabilityLLM Uncertainty Estimation

  5. Beyond Dense States: Sparse Transcoders as Causally Testable Operators for LLM Latent Reasoning

    Feb 2, 2026Yadong Wang, Haodong Chen, Yu Tian +3Sparse AutoencodersContinuous Latent Reasoning

  6. Continuous-Utility Direct Preference Optimization

    Jan 31, 2026Muhammad Ahmed Mohsin, Muhammad Umer, Emily FoxLLM AlignmentDirect Preference Optimization

  7. Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization

    Jan 29, 2026Jiecong Wang, Hao Peng, Zhanyi Wang +2LLM PlanningEfficient Language Model Reasoning

  8. Triggering Chain-of-Thought via Latent Feature Interventions in Large Language Models

    Jan 12, 2026Zhenghao He, Guangzhi Xiong, Bohan Liu +2LLM InterpretabilityCoT Reasoning

  9. Entropy-Aware Token Rejection for Improving Speculative Decoding

    Dec 29, 2025Tiancheng Su, Meicong Zhang, Guoxiu HeSpeculative DecodingLLM Inference Acceleration

  10. Enhancing Large Language Model-Based Systems for End-to-End Circuit Analysis Problem Solving

    Dec 10, 2025Liangliang Chen, Weiyu Sun, Huiru Xie +2LLM Answer VerificationEducational Technology

  11. Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles

    Nov 8, 2025Fatima Jahara, Mark Dredze, Sharon LevyGender Bias in Language ModelsLanguage Model Bias Evaluation

  12. CoT-X: An Adaptive Framework for Cross-Model Chain-of-Thought Transfer and Optimization

    Nov 7, 2025Ziqian Bi, Yinzhi Wang, Tianyang Wang +6Efficient Language Model ReasoningLLM Inference Acceleration

  13. Mitigating Hallucination in Large Language Models: A Capability-Oriented Survey on RAG, Reasoning, and Agentic Systems

    Oct 28, 2025Yihan Li, Xiyuan Fu, Ghanshyam Verma +2Retrieval-Augmented GenerationLLM Hallucination Mitigation

  14. Learning to Reason Efficiently with Discounted Reinforcement Learning

    Oct 27, 2025Alex Ayoub, Kavosh Asadi, Dale Schuurmans +2Reinforcement LearningRL for Language Model Reasoning

  15. RLIE: Rule Generation with Logistic Regression, Iterative Refinement, and Evaluation for Large Language Models

    Oct 22, 2025Yang Yang, Hua XU, Zhangyi Hu +1Logistic RegressionNeuro-Symbolic Reasoning

  16. A Model Can Help Itself: Reward-Free Self-Training for LLM Reasoning

    Oct 21, 2025Mengqi Li, Lei Zhao, Anthony Man-Cho So +2Self-Training for Language ModelsMathematical Reasoning

  17. Make an Offer They Can't Refuse: Grounding Bayesian Persuasion in Real-World Dialogues without Pre-Commitment

    Oct 15, 2025Buwei He, Yang Liu, Zhaowei Zhang +6Game TheoryLLM Decision-Making

  18. Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?

    Oct 14, 2025Shouren Wang, Wang Yang, Xianxuan Long +4LLM Reasoning

  19. Deductive Logic in Language Models: Horizontal vs Vertical Reasoning

    Oct 10, 2025Davide Maltoni, Matteo FerraraTransformer InterpretabilityCoT Reasoning

  20. Explore-Execute Chain: Towards an Efficient Structured Reasoning Paradigm

    Sep 28, 2025Kaisen Yang, Tinghe Zhang, Rushi Shah +4LLM Inference EfficiencyLLM Planning

  21. Predicting LLM Reasoning Performance with Small Proxy Model

    Sep 25, 2025Woosung Koh, Juyoung Suk, Sungjun Han +2Language Model PretrainingLLM Evaluation

  22. Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning

    Sep 1, 2025Kaviraj Pather, Elena Hadjigeorgiou, Arben Krasniqi +4LLM InterpretabilityHuman-in-the-Loop AI

  23. PiCSAR: Probabilistic Confidence Selection And Ranking for Reasoning Chains

    Aug 29, 2025Joshua Ong Jun Leang, Zheng Zhao, Aryo Pradipta Gema +7Confidence Estimation in Language ModelsBest-of-N Sampling

  24. Fast, Slow, and Tool-augmented Thinking for LLMs: A Review

    Aug 17, 2025Xinda Jia, Jinpeng Li, Zezhong Wang +6LLM Tool UseLLM Reasoning