LLM Reasoning Strategies

Latest papers 797

All topics
CardsList
  1. Learning When to Sample: Confidence-Aware Selective Sampling for Efficient Chain-of-Thought Reasoning

    Mar 9, 2026Juming Xiong, Kevin Guo, Congning Ni +7LLM Reasoning StrategiesChain-of-Thought Reasoning

  2. Step-Level Sparse Autoencoder for Reasoning Process Interpretation

    Mar 3, 2026Xuan Yang, Jiayu Liu, Yuhang Lai +3LLM Reasoning StrategiesImproving Sparse Autoencoders

  3. HEARTS: Benchmarking LLM Reasoning on Health Time Series

    Feb 25, 2026Sirui Li, Shuhan Xiao, Mihir Joshi +4Clinical Reasoning TrainingLarge Language Model Benchmarks

  4. Tool Use Reduces Depth-Induced Collapse in OOD Reasoning

    Feb 24, 2026David Koplow, Tomer Galanti, Tomaso PoggioLLM Reasoning StrategiesOut-Of-Distribution

  5. CausalFlip: A Benchmark for LLM Causal Judgment Beyond Semantic Matching

    Feb 23, 2026Yuzhe Wang, Yaochen Zhu, Jundong LiCausal ReasoningLLM Reasoning Strategies

  6. FloCA: Towards Faithful and Logically Consistent Flowchart Reasoning

    Feb 15, 2026Jinzi Zou, Bolin Wang, Shuo Zhang +2Reasoning GraphsLLM Reasoning Strategies

  7. To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models

    Feb 13, 2026Haoqing Wang, Xiang Long, Ziheng Li +3Reinforcement Learning With Verifiable RewardLLM Reasoning Strategies

  8. Neuro-Symbolic Synergy for World Modeling

    Feb 11, 2026Hongyu Zhao, Siyu Zhou, Haolin Yang +2Neuro-Symbolic FrameworkLLM Reasoning Strategies

  9. Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation

    Feb 10, 2026Pei-Chi Pan, Yingbin Liang, Sen LinLLM Reasoning Strategies

  10. rePIRL: Learn PRM with Inverse RL for LLM Reasoning

    Feb 8, 2026Xian Wu, Kaijie Zhu, Ying Zhang +2Process Reward ModelLarge Language Model Reinforcement Learning

  11. IESR:Efficient MCTS-Based Modular Reasoning for Text-to-SQL with Large Language Models

    Feb 5, 2026Tao Liu, Jiafan Lu, Bohan Yu +11Text-To-SqlLLM Reasoning Strategies

  12. CoT is Not the Chain of Truth: An Empirical Internal Analysis of Reasoning LLMs for Fake News Generation

    Feb 4, 2026Zhao Tong, Chunlin Gong, Yiping Zhang +5Large Language Model SafetyLLM Reasoning Strategies

  13. Distilling LLM Reasoning into Graph of Concept Predictors

    Feb 3, 2026Ziyang Yu, Liang ZhaoDataset DistillationLLM Reasoning Strategies

  14. Uncertainty Localization in LLM Reasoning via Embedding Perturbations

    Feb 2, 2026Qihao Wen, Jiahao Wang, Yang Nan +3Large Language Model UncertaintyLLM Reasoning Strategies

  15. Policy of Thoughts: Scaling Test-Time Training for LLM Reasoning via Online Policy Evolution

    Jan 28, 2026Zhengbo Jiao, Hongyu Xian, Qinglong Wang +5LLM Reasoning StrategiesLarge Language Model Policy Optimization

  16. LLMs versus the Halting Problem: Characterizing Program Termination Reasoning

    Jan 26, 2026Oren Sultan, Jordi Armengol-Estape, Pascal Kesseli +4Formal VerificationLLM Reasoning Strategies

  17. A Survey of Agentic Reasoning for Large Language Models: Towards Recursively Self-Improving and Collective Agents

    Jan 18, 2026Tianxin Wei, Ting-Wei Li, Zhining Liu +26Agentic ReasoningLLM Reasoning Strategies

  18. R2^2PO: Decoupling Rollout and Inference Policies for LLM Reasoning

    Jan 17, 2026Jingchu Wang, Bingbing Xu, Yige Yuan +4LLM Reasoning StrategiesFrictive Policy Optimization

  19. Programming over Thinking: Efficient and Robust Multi-Constraint Planning

    Jan 14, 2026Derrick Goh Xin Deik, Quanyu Long, Zhengyuan Liu +2Large Language Model PlanningClassical Planning

  20. Do Language Models Reason Across Languages?

    Jan 10, 2026Yan Meng, Wafaa Mohammed, Christof MonzMultilingual Language ModelsLLM Reasoning Strategies

  21. Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models

    Jan 6, 2026Zhibo Hu, Chen Wang, Yanfeng Shu +2LLM Reasoning StrategiesLarge Reasoning Models

  22. Alpha-R1: Alpha Screening with LLM Reasoning via Reinforcement Learning

    Dec 29, 2025Zuoyou Jiang, Li Zhao, Rui Sun +6LLM Reasoning StrategiesScreening

  23. KBQA-R1: Reinforcing Large Language Models for Knowledge Base Question Answering

    Dec 10, 2025Xin Sun, Zhongqi Chen, Xing Zheng +6LLM Reasoning StrategiesKnowledge Graphs

  24. Multilingual Medical Reasoning for Question Answering with Large Language Models

    Dec 5, 2025Pietro Ferrazzi, Aitor Soroa, Rodrigo AgerriMultilingual Healthcare Q&AClinical Reasoning Training

  25. ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models

    Nov 24, 2025Long Lian, Sida Wang, Felix Juefei-Xu +7LLM Reasoning StrategiesInference Latency

  26. A Neurosymbolic Approach to Natural Language Formalization and Verification

    Nov 12, 2025Chenyang An, Sam Bayless, Stefano Buliani +27Formal VerificationLLM Reasoning Strategies

  27. Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles

    Nov 8, 2025Fatima Jahara, Mark Dredze, Sharon LevyLarge Language Model BiasLLM Reasoning Strategies

  28. Reinforcement Learning Improves Traversal of Parametric Knowledge in LLMs

    Nov 8, 2025Renfei Zhang, Manasa Kaniselvan, Rylan Schaeffer abd Niloofar MireshghallahLLM Reasoning StrategiesFactual Recall

  29. Multi-Step Knowledge Interaction Analysis via Rank-2 Subspace Disentanglement

    Nov 3, 2025Sekh Mainul Islam, Pepa Atanasova, Isabelle AugensteinLLM Reasoning StrategiesContextual Grounding

  30. OpenSIR: Open-Ended Self-Improving Reasoner

    Nov 1, 2025Wai-Chung Kwan, Joshua Ong Jun Leang, Pavlos Vougiouklis +3LLM Reasoning StrategiesSelf-Play

  31. Scaling Latent Reasoning via Looped Language Models

    Oct 29, 2025Rui-Jie Zhu, Zixuan Wang, Kai Hua +30LLM Reasoning StrategiesEfficient Latent Reasoning

  32. Mitigating Hallucination in Large Language Models: A Capability-Oriented Survey on RAG, Reasoning, and Agentic Systems

    Oct 28, 2025Yihan Li, Xiyuan Fu, Ghanshyam Verma +2Hallucination MitigationLLM Reasoning Strategies

  33. RLIE: Rule Generation with Logistic Regression, Iterative Refinement, and Evaluation for Large Language Models

    Oct 22, 2025Yang Yang, Hua XU, Zhangyi Hu +1LLM Reasoning StrategiesProbabilistic Model

  34. A Model Can Help Itself: Reward-Free Self-Training for LLM Reasoning

    Oct 21, 2025Mengqi Li, Lei Zhao, Anthony Man-Cho So +2LLM Reasoning StrategiesMathematical Reasoning Benchmarks

  35. Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?

    Oct 14, 2025Shouren Wang, Wang Yang, Xianxuan Long +4LLM Reasoning Strategies

  36. Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts

    Oct 10, 2025Xinyi Wang, Jinyi Han, Zishang Jiang +7LLM Reasoning StrategiesLarge Language Model Reinforcement Learning

  37. Rethinking Reward Models for Multi-Domain Test-Time Scaling

    Oct 1, 2025Dong Bok Lee, Seanie Lee, Sangwoo Park +12Process Reward ModelLLM Reasoning Strategies

  38. Interactive Learning for LLM Reasoning

    Sep 30, 2025Hehai Lin, Shilei Cao, Sudong Wang +5LLM Reasoning StrategiesInteractive Learning

  39. Reasoning or Rambling? Exploring the Effect of Thinking on Agent Persuasion

    Sep 25, 2025Haodong Zhao, Jidong Li, Zhaomin Wu +4PersuasionLLM Reasoning Strategies

  40. Predicting LLM Reasoning Performance with Small Proxy Model

    Sep 25, 2025Woosung Koh, Juyoung Suk, Sungjun Han +2LLM Reasoning StrategiesBridge

  41. Discovering New Theorems via LLMs with In-Context Proof Learning in Lean

    Sep 16, 2025Kazumi Kasaura, Naoto Onda, Yuta Oriike +3Theorem ProvingLLM Reasoning Strategies

  42. Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning

    Sep 1, 2025Kaviraj Pather, Elena Hadjigeorgiou, Arben Krasniqi +4LLM Reasoning StrategiesChain-of-Thought Reasoning

  43. ReST-RL: Reinforcing LLM Reasoning through Unified Self-Training and Value-Guided Search

    Aug 27, 2025Sining Zhoubian, Dan Zhang, Jie TangLLM Reasoning StrategiesLarge Language Model Reinforcement Learning

  44. When Tools Hurt LLM Reasoning: State-Dependent Belief Revision under External Evidence

    Aug 21, 2025Yufeng Zhao, Junnan Liu, Hongwei Liu +4LLM Reasoning Strategies

  45. Fast, Slow, and Tool-augmented Thinking for LLMs: A Review

    Aug 17, 2025Xinda Jia, Jinpeng Li, Zezhong Wang +6LLM Reasoning StrategiesReasoning Skills

  46. Beyond Scaling Law: A Data-Efficient Distillation Framework for Reasoning

    Aug 13, 2025Xiaojun Wu, Xiaoguang Jiang, Huiyang Li +11LLM Reasoning StrategiesDataset Distillation

  47. Rethinking Prospect Theory for LLMs: Revealing the Instability of Decision-Making under Epistemic Uncertainty

    Aug 12, 2025Rui Wang, Qihan Lin, Jiayu Liu +7Large Language Model UncertaintyLLM Reasoning Strategies

  48. FedCoT: Communication-Efficient Federated Reasoning Enhancement for Large Language Models

    Aug 7, 2025Chuan Li, Qianyi Zhao, Fengran Mo +1LLM Reasoning Strategies

  49. The Bidirectional Process Reward Model

    Aug 3, 2025Lingyin Zhang, Jun Gao, Xiaoxue Ren +1Process Reward ModelLLM Reasoning Strategies

  50. Disentangling Reasoning Logic to Resolve Explicit Knowledge Conflicts

    Aug 2, 2025Xianda Zheng, Zijian Huang, Meng-Fen Chiang +4LLM Reasoning StrategiesReasoning Skills

  51. Medical Reasoning in the Era of LLMs: A Systematic Review of Enhancement Techniques and Applications

    Aug 1, 2025Zizhan Ma, Wenxuan Wang, Meidan Ding +7Clinical Reasoning TrainingLLM Reasoning Strategies

  52. Post-Training Large Language Models via Reinforcement Learning from Self-Feedback

    Jul 29, 2025Carel van Niekerk, Renato Vukovic, Benjamin Ruppik +3Large Language Model Reinforcement LearningLLM Reasoning Strategies

  53. Knowing When to Critique: Task-Adaptive Metacognitive Regulation for Reliable LLM Reasoning

    Jul 20, 2025Xinmeng Hou, Ziting Chang, Zhouquan Lu +5LLM Reasoning StrategiesCritique