LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 654

All topics
CardsList
  1. Reasoning Can Be Restored by Correcting a Few Decision Tokens

    May 16, 2026Changshuo Shen, Leheng Sheng, Yuxin Chen +2Efficient Language Model ReasoningInference-Time Compute Allocation

  2. Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning

    May 16, 2026Shuo Liu, Ding Liu, Shi-Ju RanConfidence Estimation in Language ModelsLLM Reliability

  3. Distributional Energy-Based Models for Uncertainty-Aware Structured LLM Reasoning

    May 15, 2026Shireen Kudukkil Manchingal, Abhey Kalia, Fernanda Gonçalves +1LLM Answer VerificationEnergy-Based Models

  4. SGR: A Stepwise Reasoning Framework for LLMs with External Subgraph Generation

    May 15, 2026Xin Zhang, Yang Cao, Baoxing Wu +2LLM GroundingKnowledge Augmentation for Language Models

  5. MHGraphBench: Knowledge Graph-Grounded Benchmarking of Mental Health Knowledge in Large Language Models

    May 15, 2026Weixin Liu, Congning Ni, Shelagh A. Mulvaney +4LLM EvaluationHealthcare

  6. CAPS: Cascaded Adaptive Pairwise Selection for Efficient Parallel Reasoning

    May 15, 2026Fangzhou Lin, Shuo Xing, Peiran Li +6Pairwise ComparisonPairwise Preference Evaluation

  7. Reasoning Models Don't Just Think Longer, They Move Differently

    May 14, 2026Anders Gjølbye, Lars Kai Hansen, Sanmi KoyejoLLM InterpretabilityRepresentation Geometry in Language Models

  8. OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation

    May 14, 2026Shang Zhou, Wenhao Chai, Kaiyuan Liu +3Pairwise ComparisonTest-Time Optimization

  9. A Deterministic Agentic Workflow for HS Tariff Classification: Multi-Dimensional Rule Reasoning with Interpretable Decisions

    May 14, 2026Yu Zhang, Dongjiang Zhuang, Qu Zhou +4Agentic WorkflowsClassification

  10. From Table to Cell: Attention for Better Reasoning with TABALIGN

    May 14, 2026Tung Sum Thomas Kwok, Zeyong Zhang, Xinyu Wang +6Table QAStructured Reasoning

  11. Stateful Reasoning via Insight Replay

    May 14, 2026Bin Lei, Caiwen Ding, Jiachen Yang +2Memory-Augmented Language ModelsCoT Reasoning

  12. LLMs Know When They Know, but Do Not Act on It: A Metacognitive Harness for Test-time Scaling

    May 13, 2026Qi Cao, Yufan Wang, Peijia Qin +2LLM InferenceTest-Time Scaling

  13. Inference-Time Amplification of Weak Reasoning Models

    May 13, 2026Varun Sunkaraneni, Pierfrancesco Beneventano, Riccardo Neumarker +2Inference-Time ScalingLLM Reasoning

  14. Pause and Reflect: Conformal Aggregation for Chain-of-Thought Reasoning

    May 13, 2026Yu Gu, Zijun Yu, Vahid Partovi Nia +1Selective PredictionSelf-Consistency Decoding

  15. Enhanced and Efficient Reasoning in Large Learning Models

    May 13, 2026Leslie G. ValiantRepresentation LearningWorld Models

  16. (How) Do Large Language Models Understand High-Level Message Sequence Charts?

    May 13, 2026Mohammad Reza MousaviLLM EvaluationChart Understanding

  17. What properties of reasoning supervision are associated with improved downstream model quality?

    May 13, 2026Mikołaj Langner, Dzmitry Pihulski, Jan Eliasz +5Training Data SelectionLLM Reasoning

  18. Respecting Self-Uncertainty in On-Policy Self-Distillation for Efficient LLM Reasoning

    May 13, 2026Junlong Ke, Zichen Wen, Weijia Li +2On-Policy Self-DistillationRL for Language Model Reasoning

  19. GateKD: Confidence-Gated Closed-Loop Distillation for Robust Reasoning

    May 13, 2026Kasidit Sermsri, Teerapong PanboonyuenCoT DistillationLanguage Model Distillation

  20. CommonWhy: A Dataset for Evaluating Entity-Based Causal Commonsense Reasoning in Large Language Models

    May 13, 2026Armin Toroghi, Faeze Moradi Kalarde, Scott SannerAbductive ReasoningCausal Reasoning in Language Models

  21. LGMT: Logic-Grounded Metamorphic Testing for Evaluating the Reasoning Reliability of LLMs

    May 12, 2026Zenghui Zhou, Man Li, Xiaoke Fang +3LLM EvaluationAutomated Software Testing

  22. Solve the Loop: Attractor Models for Language and Reasoning

    May 12, 2026Jacob Fein-Ashley, Paria RashidinejadLanguage Model PretrainingRecurrent Transformers

  23. Context Convergence Improves Answering Inferential Questions

    May 12, 2026Jamshid Mozafari, Bhawna Piryani, Adam JatowtQuestion AnsweringLLM Reasoning

  24. Goal-Oriented Reasoning for RAG-based Memory in Conversational Agentic LLM Systems

    May 12, 2026Jiazhou Liang, Armin Toroghi, Yifan Simon Liu +3Multi-Hop QAAgentic RAG

  25. From Noise to Diversity: Random Embedding Injection in LLM Reasoning

    May 12, 2026Heejun Kim, Seungpil Lee, Jewon Yeom +5LLM PromptingLLM Reasoning

  26. Targeted Tests for LLM Reasoning: An Audit-Constrained Protocol

    May 12, 2026Hongmin LiPrompt SensitivityLanguage Model Robustness