LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. MHGraphBench: Knowledge Graph-Grounded Benchmarking of Mental Health Knowledge in Large Language Models

    May 15, 2026Weixin Liu, Congning Ni, Shelagh A. Mulvaney +4LLM EvaluationHealthcare

  2. CAPS: Cascaded Adaptive Pairwise Selection for Efficient Parallel Reasoning

    May 15, 2026Fangzhou Lin, Shuo Xing, Peiran Li +6Pairwise ComparisonPairwise Preference Evaluation

  3. Reasoning Models Don't Just Think Longer, They Move Differently

    May 14, 2026Anders Gjølbye, Lars Kai Hansen, Sanmi KoyejoLLM InterpretabilityRepresentation Geometry in Language Models

  4. OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation

    May 14, 2026Shang Zhou, Wenhao Chai, Kaiyuan Liu +3Pairwise ComparisonTest-Time Optimization

  5. A Deterministic Agentic Workflow for HS Tariff Classification: Multi-Dimensional Rule Reasoning with Interpretable Decisions

    May 14, 2026Yu Zhang, Dongjiang Zhuang, Qu Zhou +4Agentic WorkflowsClassification

  6. From Table to Cell: Attention for Better Reasoning with TABALIGN

    May 14, 2026Tung Sum Thomas Kwok, Zeyong Zhang, Xinyu Wang +6Table QAStructured Reasoning

  7. Stateful Reasoning via Insight Replay

    May 14, 2026Bin Lei, Caiwen Ding, Jiachen Yang +2Memory-Augmented Language ModelsCoT Reasoning

  8. LLMs Know When They Know, but Do Not Act on It: A Metacognitive Harness for Test-time Scaling

    May 13, 2026Qi Cao, Yufan Wang, Peijia Qin +2LLM InferenceTest-Time Scaling

  9. Inference-Time Amplification of Weak Reasoning Models

    May 13, 2026Varun Sunkaraneni, Pierfrancesco Beneventano, Riccardo Neumarker +2Inference-Time ScalingLLM Reasoning

  10. Pause and Reflect: Conformal Aggregation for Chain-of-Thought Reasoning

    May 13, 2026Yu Gu, Zijun Yu, Vahid Partovi Nia +1Selective PredictionSelf-Consistency Decoding

  11. Enhanced and Efficient Reasoning in Large Learning Models

    May 13, 2026Leslie G. ValiantRepresentation LearningWorld Models

  12. (How) Do Large Language Models Understand High-Level Message Sequence Charts?

    May 13, 2026Mohammad Reza MousaviLLM EvaluationChart Understanding

  13. What properties of reasoning supervision are associated with improved downstream model quality?

    May 13, 2026Mikołaj Langner, Dzmitry Pihulski, Jan Eliasz +5Training Data SelectionLLM Reasoning

  14. Respecting Self-Uncertainty in On-Policy Self-Distillation for Efficient LLM Reasoning

    May 13, 2026Junlong Ke, Zichen Wen, Weijia Li +2On-Policy Self-DistillationRL for Language Model Reasoning

  15. GateKD: Confidence-Gated Closed-Loop Distillation for Robust Reasoning

    May 13, 2026Kasidit Sermsri, Teerapong PanboonyuenCoT DistillationLanguage Model Distillation

  16. CommonWhy: A Dataset for Evaluating Entity-Based Causal Commonsense Reasoning in Large Language Models

    May 13, 2026Armin Toroghi, Faeze Moradi Kalarde, Scott SannerAbductive ReasoningCausal Reasoning in Language Models

  17. LGMT: Logic-Grounded Metamorphic Testing for Evaluating the Reasoning Reliability of LLMs

    May 12, 2026Zenghui Zhou, Man Li, Xiaoke Fang +3LLM EvaluationAutomated Software Testing

  18. Solve the Loop: Attractor Models for Language and Reasoning

    May 12, 2026Jacob Fein-Ashley, Paria RashidinejadLanguage Model PretrainingRecurrent Transformers

  19. Context Convergence Improves Answering Inferential Questions

    May 12, 2026Jamshid Mozafari, Bhawna Piryani, Adam JatowtQuestion AnsweringLLM Reasoning

  20. Goal-Oriented Reasoning for RAG-based Memory in Conversational Agentic LLM Systems

    May 12, 2026Jiazhou Liang, Armin Toroghi, Yifan Simon Liu +3Multi-Hop QAAgentic RAG

  21. From Noise to Diversity: Random Embedding Injection in LLM Reasoning

    May 12, 2026Heejun Kim, Seungpil Lee, Jewon Yeom +5LLM PromptingLLM Reasoning

  22. Targeted Tests for LLM Reasoning: An Audit-Constrained Protocol

    May 12, 2026Hongmin LiPrompt SensitivityLanguage Model Robustness

  23. Deep Reasoning in General Purpose Agents via Structured Meta-Cognition

    May 12, 2026Dean Light, Michael Theologitis, Kshitish Ghate +7Structured ReasoningAgentic Reasoning

  24. DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

    May 11, 2026Mengyi Deng, Zhiwei Li, Xin Li +4LLM AlignmentReasoning Consistency in Language Models

  25. SLASH the Sink: Sharpening Structural Attention Inside LLMs

    May 11, 2026Yiming Liu, Bin Lu, Xinbing Wang +2LLM Reasoning with GraphsLLM Interpretability

  26. Teaching LLMs to See Graphs: Unifying Text and Structural Reasoning

    May 11, 2026Dario VajdaLLM Reasoning with GraphsText-Attributed Graph Learning