LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. The Deterministic Horizon: When Extended Reasoning Fails and Tool Delegation Becomes Necessary

    May 29, 2026Dongxin Guo, Jikun Wu, Siu Ming YiuLLM Reasoning

  2. Quantized Reasoning Models Think They Need to Think Longer, but They Do Not

    May 29, 2026Sanae Lotfi, Polina Kirichenko, Steven Li +1Overthinking in Language ModelsCoT Reasoning

  3. What Am I Missing? Question-Answering as Hidden State Probing

    May 29, 2026Chu Fei Luo, Samuel Dahan, Xiaodan ZhuLLM Self-RefinementLanguage Model Self-Assessment

  4. LinTree: Improving LLM Reasoning with Explicitly Structured Search Histories

    May 29, 2026Liwei Kang, Yee Whye Teh, Wee Sun LeeInference-Time SearchTree of Thoughts

  5. Fighting Numerical Hallucinations via Data-centric Compilation for Online Financial QA

    May 29, 2026Hao Chen, Xing Tang, Qirui Liu +6Retrieval-Augmented GenerationHallucination in Language Models

  6. Reasoning with Sampling: Cutting at Decision Points

    May 28, 2026Felix Zhou, Anay Mehrotra, Quanquan C. LiuMarkov Chain Monte CarloEfficient Language Model Reasoning

  7. Same Evidence, Different Answers: Canonical-Context On-Policy Distillation for Multi-Turn Language Models

    May 28, 2026Zizhuo Lin, Quanling Liu, Jinsheng Quan +6LLM GroundingReasoning Consistency in Language Models

  8. GRUFF: LLM Pronoun Fidelity, Reasoning, and Biases in German

    May 28, 2026Fabian Mewes, Anne Lauscher, Vagrant GautamGender Bias in Language ModelsLinguistic Bias in Language Models

  9. Conformal Certification of Reasoning Trace Prefixes

    May 28, 2026Matt Y. Cheung, Ashok Veeraraghavan, Hanjie Chen +1Conformal PredictionLanguage Model Calibration

  10. ESPO: Early-Stopping Proximal Policy Optimization

    May 28, 2026Zihang Li, Rui Zhou, Yingcheng Shi +8Early StoppingReinforcement Learning

  11. Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies

    May 28, 2026Yuxuan Ye, Raul Santos-Rodriguez, Edwin SimpsonLLM GroundingClaim Verification

  12. TRACE: Toulmin-based Reasoning Assessment through Constructive Elements for LLM CoT Evaluation

    May 28, 2026Yundong Kim, Heyoung YangLLM EvaluationLanguage Model Generation Evaluation

  13. SURGENT: A Surgical Multi-Agent Assistance System Across the Perioperative Workflow

    May 28, 2026Dongsheng Shi, Yue Li, Xin Yi +3Multi-Agent LLM SystemsClinical Decision Support

  14. Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization

    May 28, 2026Junlin He, Yihong Tang, Tong Nie +5LLM PruningLLM Compression

  15. Rethinking Stepwise Model Routing: A Cost-Efficient Table Reasoning Perspective

    May 28, 2026Shenghao Ye, Yuxiang Wang, Yu Guo +3Cost-Aware InferenceLLM Uncertainty Estimation

  16. Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces

    May 28, 2026Chen He, Yuhao Wu, Lei Wang +2Fine-TuningLLM Fine-Tuning

  17. ReasonOps: Operator Segmentation for LLM Reasoning Traces

    May 28, 2026Daniel Lee, Owen Queen, James ZouCoT EvaluationCoT Reasoning

  18. Skill-Conditioned Gated Self-Distillation for LLM Reasoning

    May 27, 2026Jiazhen Huang, Xiao Chen, Xiao Luo +3Mathematical ReasoningSelf-Distillation

  19. Reasoning that Travels: Dissecting How Chain-of-Thought Transfers Across Models

    May 27, 2026Xinyuan Cheng, Beiduo Chen, Philipp Mondorf +1LLM PromptingLLM Reasoning

  20. CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

    May 27, 2026Linas Nasvytis, Simon Jerome Han, Ben Prystawski +3LLM Self-RefinementEfficient Language Model Reasoning

  21. The Importance of Being Statistically Earnest: A Critical Re-evaluation of GSM-Symbolic

    May 27, 2026Dominika Agnieszka Długosz, Arlindo Oliveira, Natalia Díaz-RodríguezLLM EvaluationGeneralized Linear Models

  22. Satisfiability Solving with LLMs: A Matched-Pair Evaluation of Reasoning Capability

    May 27, 2026Leizhen Zhang, Shuhan Chen, Sheng ChenLLM EvaluationConstraint Satisfaction

  23. ProvMind: Provenance-grounded reasoning for materials synthesis

    May 27, 2026Yiming Zhang, Ryo Tamura, Koji TsudaReasoning EvaluationMaterials Science

  24. Revisiting Anthropomorphic Reflection Markers in Large Language Model Reasoning

    May 27, 2026Yahan Yu, Noa Nakanishi, Fei ChengLLM Reasoning

  25. CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models

    May 27, 2026Yukyung Lee, Yumeng Shen, Jinhyeong Park +2CoT ReasoningEfficient Language Model Reasoning

  26. Self-Consistency via Marginal Sharpening

    May 27, 2026Aleksei Arzhantsev, Otmane Sakhi, Nicolas ChopinEfficient Language Model ReasoningReasoning Consistency in Language Models