LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Can LLMs in Draft-Verify-Revise Pipelines Resolve Deictic Ambiguity?

    Sep 14, 2026Obinna I. EkekezieCoreference ResolutionLLM Answer Verification

  2. Chopthin-Consensus Power Sampling: A Diversity-Preserving Approach to LLM Decoding

    Sep 14, 2026Minoo Ahmadi, Seyedarmin Azizi, Erfan Baghaei Potraghloo +2Language Model DecodingLLM Inference

  3. Separating Engineering Reasoning from DEXPI Serialization in LLM-Based Greenfield Surface-Process Design: A Three-Case Study for Underground Gas Storage

    Sep 14, 2026Qingchuan Zhu, Shuyue Tong, Pengju RenStructured Output GenerationLLM Reasoning

  4. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment

    Sep 12, 2026Jiayu Huang, Zichen Tang, Qianhui Ling +2Reasoning Consistency in Language ModelsClinical Language Model Evaluation

  5. Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM Reasoning

    Sep 12, 2026Bincheng Gu, Min Gao, Zongwei Wang +3Test-Time AdaptationLLM Reliability

  6. Negative Self-Distillation: Learning to Reason by Avoiding Flaws

    Sep 10, 2026Rongcan Pei, Zhepei Wei, Shuyao Xu +3Language Model DistillationSelf-Distillation

  7. Quantifying Logical Consistency in Transformers via Query-Key Alignment

    Sep 10, 2026Eduard Tulchinskii, Anastasia Voznyuk, Laida Kushnareva +4Transformer InterpretabilityLLM Evaluation

  8. CompassOPD: Cross-Family On-Policy Distillation via Within-Family Likelihood Shifts

    Sep 9, 2026Naibin Gu, Qingyi Si, Chenxu Yang +5Language Model DistillationOn-Policy Distillation

  9. Answer-Distribution Trajectories: A Stochastic-Dynamics View of LLM Reasoning

    Sep 8, 2026Mar Gonzàlez I Català, Haitz Sáez de Ocáriz Borde, Davide Murari +3LLM Uncertainty EstimationLLM Reasoning

  10. Difficulty-Adaptive Tree-Structured Policy Optimization for Expanding Reasoning Coverage in RLVR

    Sep 8, 2026Youngjun Yu, Sanghwan Jang, Hwanjo YuRL for Language Model ReasoningRL Exploration

  11. The Internal Anatomy of Strategic Choice in Large Language Models

    Sep 7, 2026Vinícius Ferraz, Leon Houf, Enrico FerreaLLM InterpretabilityStrategic Reasoning Risks in Language Models

  12. Long-Horizon Language Model Reinforcement Learning via Progressive Point Matching

    Sep 7, 2026Preston Fu, Kevin Frans, Oleh Rybkin +2Reinforcement LearningReward Shaping

  13. Extremely Sparse Supervision Incentivizes Reasoning Ability

    Sep 7, 2026Zhishuai Liu, Xingzi Xu, Mehmet Saygin Seyfioglu +2On-Policy DistillationLanguage Model Post-Training

  14. DODR: Deterministic Operator-Driven Reasoning in Latent Space

    Sep 7, 2026Weicai Huang (Beijing MQPat Technologies, Co., Ltd.)Logical ReasoningAbductive Reasoning

  15. GrowPage: On-Demand KV Budgeting for Efficient LLM Reasoning Serving

    Sep 3, 2026Qiankun Ma, Yanjiang Zhou, Zinan Xiong +5LLM InferenceKV Caching

  16. Language-encoded network topology enables large language models to reason about complex networks

    Sep 3, 2026Ucchwas Talukder Utsha, Sakib Mostafa, James Zou +1Graph Representation LearningLLM Reasoning with Graphs

  17. Cliff: Learning Process Rewards from the First Mistake

    Sep 2, 2026Peixuan Han, Runhui Wang, Ketan Ramaneti +3Reinforcement Learning with Verifiable RewardsLLM Reasoning

  18. Large Language Models (LLMs) for Telecom Root Cause Analysis (RCA): A Structured Reasoning Framework for Evidence-Grounded Diagnosis

    Sep 2, 2026Hao Zhou, Mandar Kulkarni, Hao Chen +3Root Cause AnalysisLLM Reasoning

  19. Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall

    Sep 1, 2026Jacqueline He, Howard Yen, Shuyue Stella Li +9Language Model DistillationFactual Knowledge in Language Models

  20. RPCBench: A Benchmark for Proactive Premise Critique in LLM-based Recommendation

    Sep 1, 2026Zhongru Chen, Yuan Wu, Yi ChangLLM EvaluationLarge Language Model-Based Recommendation

  21. Learning What to Practice: Diagnosis-Guided Self-Evolution for Language Models

    Sep 1, 2026Xincheng Wei, Yifan Ding, Fucheng Xiong +6Self-Training for Language ModelsLanguage Model Self-Improvement

  22. A Model with No Head and Many Thoughts

    Aug 31, 2026Nikita Koriagin, Yaroslav Aksenov, George Bredis +3Efficient Language Model ReasoningLLM Inference Acceleration

  23. Wrong Prediction, Right Answer: Recovering Evidence from Collapsed LLM Sequence Scores

    Aug 31, 2026Qiyao Yan, Chenpeng Wang, Liangming PanLLM EvaluationLanguage Model Calibration

  24. CARVE: Verified Expansion for Variable-Length Generation in Diffusion Language Models

    Aug 31, 2026Wail Bouhedja, Amr Mohamed, Guokan ShangMasked Diffusion ModelsLLM Inference Acceleration

  25. LCoT-GV: Graph Attention Networks for Verifying Long Reasoning Chains in Large Language Models

    Aug 31, 2026Bérénice Jaulmes, Mehwish AlamLLM Reasoning with GraphsLLM Reasoning