LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Beyond Imitation: Reflective On-Policy Self-Distillation for LLM Reasoning

    May 27, 2026Ziqi Zhao, Xinyu Ma, Liu Yang +6On-Policy Self-DistillationLanguage Model Distillation

  2. Integrated and Cross-Architecture Interpretation of LLM Reasoning

    May 27, 2026Leonardo Matthew Yauw, Wei-Bin Kou, Yujiu YangTransformer InterpretabilityLLM Interpretability

  3. The Shape of Overthinking: Backtracking Bursts in Long Reasoning Traces

    May 27, 2026Navid Rezazadeh, Arash Gholami DavoodiReasoning EvaluationEfficient Language Model Inference

  4. Revealing Algorithmic Deductive Circuits for Logical Reasoning

    May 27, 2026Phuong Minh Nguyen, Tien Huu Dang, Naoya InoueAttention Head AnalysisLLM Interpretability

  5. ReasonOps: A Unified Operational Paradigm for Trustworthy Verified LLM Reasoning

    May 26, 2026Adnan RashidLLM SafetyLLM Reasoning

  6. Recon: Reconstruction-Guided Reasoning Synthesis for User Modeling

    May 26, 2026Alan Zhu, Mihran Miroyan, Carolyn Wang +4CoT ReasoningUser Modeling

  7. GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought

    May 26, 2026Weijiang Lv, Wentong Zhao, Jiayu Wang +3CoT FaithfulnessRL for Language Model Reasoning

  8. Uncertainty-Aware Budget Allocation for Adaptive Test-Time Reasoning

    May 26, 2026Manh Nguyen, Sunil Gupta, Hung LeEfficient Language Model ReasoningAdaptive Sampling

  9. Evaluating Interactive Reasoning in Large Language Models: A Hierarchical Benchmark with Executable Games

    May 26, 2026Mingyuan Fan, Weiguang Han, Daixin Wang +3LLM EvaluationAI Agent Benchmarks

  10. Why Prompt Optimization Works, and Why It Sometimes Doesn't: A Causal-Inspired Edit-Level Analysis

    May 26, 2026Shuzhi Gong, Hechuan WenAutomatic Prompt OptimizationLLM Reasoning

  11. Explaining Too Much? Understanding How Large Language Model Reasoning Traces Influence Performance and Metacognition

    May 25, 2026Daniela Fernandes, Daniel Buschek, Lev Tankelevitch +2CoT ReasoningHuman-AI Interaction

  12. Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains

    May 25, 2026Hui Xie, Jie Liu, Ziyue Qiao +1Efficient Language Model ReasoningLLM Inference Acceleration

  13. RepoMirage: Probing Repository Context Reasoning in Code Agents with Perturbations

    May 25, 2026Hanyu Li, Yichi Zhang, Speed Zhu +3AI Coding AgentsSoftware Engineering Benchmarks

  14. ARBITER: Reasoning Trajectory Basins and Majority Vote Failures in Test-Time Sampling

    May 25, 2026Meng Cai, Lars Kulik, Farhana ChoudhurySelf-Consistency DecodingTest-Time Scaling

  15. Context-CoT: Enhancing Context Learning via High-Quality Reasoning Synthesis

    May 25, 2026Hongbo Jin, Mingnan Zhu, Jingqi Tian +6CoT ReasoningIn-Context Learning

  16. Inference Time Optimization with Confidence Dynamics

    May 24, 2026Yu Wang, Minghao Liu, Jiayun Wang +3Inference-Time OptimizationConfidence Estimation in Language Models

  17. Better, Faster: Harnessing Self-Improvement in Large Reasoning Models

    May 24, 2026Qihuang Zhong, Liang Ding, Juhua Liu +3Overthinking in Language ModelsRL for Language Model Reasoning

  18. Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework

    May 23, 2026Ali Şenol, Garima Agrawal, Huan LiuLLM EvaluationLanguage Model Robustness

  19. Learning to Reason Efficiently with A* Post-Training

    May 23, 2026Andreas Opedal, Francesco Ignazio Re, Abulhair Saparov +3Process Reward ModelsRL for Language Model Reasoning

  20. Hypothesis Generation and Inductive Inference in Children and Language Models

    May 23, 2026Jeffrey Qin, Wasu Top Piriyakulkij, Zhuangfei Gao +4Bayesian InferenceScientific Hypothesis Generation

  21. Understanding and Mitigating Premature Confidence for Better LLM Reasoning

    May 23, 2026Jingchu Gai, Guanning Zeng, Christina Baek +4Confidence Estimation in Language ModelsRL for Language Model Reasoning

  22. ChaosBench-Logic v2: Evaluating LLM Logical Reasoning over Dynamical Systems at Scale

    May 23, 2026Noel ThomasLLM EvaluationLanguage Model Robustness

  23. HyperGuide: Hyperbolic Guidance for Efficient Multi-Step Reasoning in Large Language Models

    May 22, 2026Yuyu Liu, Haotian Xu, Yanan He +3LLM Fine-TuningEfficient Language Model Reasoning

  24. Convergence Without Understanding: When Language Models Agree on Representations but Disagree on Reasoning

    May 22, 2026Muhammad Usama, Dong Eui ChangRepresentational Similarity AnalysisLLM Interpretability

  25. GENSTRAT: Toward a Science of Strategic Reasoning in Large Language Models

    May 22, 2026Vartan Shadarevian, Kia Ghods, Alex Kenich +1LLM EvaluationImperfect-Information Games