LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Deep Reasoning in General Purpose Agents via Structured Meta-Cognition

    May 12, 2026Dean Light, Michael Theologitis, Kshitish Ghate +7Structured ReasoningAgentic Reasoning

  2. DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

    May 11, 2026Mengyi Deng, Zhiwei Li, Xin Li +4LLM AlignmentReasoning Consistency in Language Models

  3. SLASH the Sink: Sharpening Structural Attention Inside LLMs

    May 11, 2026Yiming Liu, Bin Lu, Xinbing Wang +2LLM Reasoning with GraphsLLM Interpretability

  4. Teaching LLMs to See Graphs: Unifying Text and Structural Reasoning

    May 11, 2026Dario VajdaLLM Reasoning with GraphsText-Attributed Graph Learning

  5. Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration

    May 11, 2026Shuzhang Zhong, Haochen Huang, Shengxuan Qiu +3Inference-Time SearchTree of Thoughts

  6. FERA: Uncertainty-Aware Federated Reasoning for Large Language Models

    May 11, 2026Ruhan Wang, Chengkai Huang, Zhiyong Wang +6LLM ReasoningFederated Learning

  7. TeleResilienceBench: Quantifying Resilience for LLM Reasoning in Telecommunications

    May 11, 2026Pranshav Gajjar, Emmanuel Ojo, Vijay K ShahLLM EvaluationLLM Reasoning

  8. Exploration-Driven Optimization for Test-Time Large Language Model Reasoning

    May 11, 2026Changhao Li, Yuchen Zhuang, Chenxiao Gao +4RL for Language ModelsInference-Time Optimization

  9. Absurd World: A Simple Yet Powerful Method to Absurdify the Real-world for Probing LLM Reasoning Capabilities

    May 10, 2026Ryan Albright, Golam Md Muktadir, Zarif Ikram +3LLM EvaluationLanguage Model Robustness

  10. Efficient LLM Reasoning via Variational Posterior Guidance with Efficiency Awareness

    May 10, 2026Zizhao Chen, Yuying Li, Siting Lin +1LLM Inference EfficiencyEfficient Language Model Reasoning

  11. Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning

    May 10, 2026Aojie Yuan, Tianqi Shen, Dajun ZhangKV-Cache OffloadingKV Caching

  12. LoopUS: Recasting Pretrained LLMs into Looped Latent Refinement Models

    May 10, 2026Taekhyun Park, Yongjae Lee, Dohee Kim +1Recurrent TransformersLLM Post-Training

  13. An Execution-Verified Multi-Language Benchmark for Code Semantic Reasoning

    May 10, 2026Yikun Li, Jinfeng Jiang, Ting Zhang +7LLM EvaluationCode Language Models

  14. RuPLaR : Efficient Latent Compression of LLM Reasoning Chains with Rule-Based Priors From Multi-Step to One-Step

    May 10, 2026Xiaocheng Luo, Kang Wang, Zaifu Zhan +2LLM CompressionCoT Compression

  15. Memorize Theorems, Not Instances: Probing SFT Generalization through Mathematical Reasoning

    May 10, 2026Ruiying Peng, Mengyu Yang, Jing Lei +3Supervised Fine-TuningMemorization in Language Models

  16. Do LLMs Experience an Internal Polylogue? Investigating Reasoning through the Lens of Personas

    May 9, 2026Nils A. Herrmann, Leander Girrbach, Kirill Bykov +1Language Model SteeringLLM Interpretability

  17. Where Larger Models Excel: The Primacy of Constraint-Guided Reasoning

    May 9, 2026Guan-Yi Lin, Hen-Hsen HuangLanguage Model Scaling LawsLLM Reasoning

  18. Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models

    May 8, 2026Aswin RRV, Jacob Dineen, Divij Handa +4Synthetic Data GenerationRL for Language Model Reasoning

  19. Abductive Reasoning with Probabilistic Commonsense

    May 8, 2026Joseph Cotnareanu, Chiara Roverato, Han Zhou +3Abductive ReasoningNeuro-Symbolic Reasoning

  20. Reliable Chain-of-Thought via Prefix Consistency

    May 8, 2026Naoto Iwase, Yuki Ichihara, Mohammad Atif Quamar +1Self-Consistency DecodingReasoning Consistency in Language Models

  21. MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing

    May 8, 2026Yinsheng Yao, Jiehao Tang, Zhaozhen Yang +1LLM AuditingMulti-Agent Debate

  22. Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance

    May 8, 2026Jiachen Yu, Zhihao Xu, Junjie Wang +1Instruction FollowingRubric-Based Evaluation

  23. Confidence-Aware Alignment Makes Reasoning LLMs More Reliable

    May 8, 2026Kejia Chen, Jiawen Zhang, Yihong Wu +5LLM AlignmentDirect Preference Optimization

  24. Implicit Compression Regularization: Concise Reasoning via Internal Shorter Distributions in RL Post-Training

    May 8, 2026Chen Wang, Hexuan Deng, Yining Zhang +5Overthinking in Language ModelsReinforcement Learning with Verifiable Rewards

  25. LaTER: Efficient Test-Time Reasoning via Latent Exploration and Explicit Verification

    May 8, 2026Xuan Li, Yining Wang, Yuchen Liu +7CoT ReasoningEfficient Language Model Reasoning

  26. From 0-Order Selection to 2-Order Judgment: Combinatorial Hardening Exposes Compositional Failures in Frontier LLMs

    May 8, 2026Hanmeng Liu, Shichao Weng, Xiulai Liu +3Logical ReasoningLLM Evaluation

  27. Structural Rationale Distillation via Reasoning Space Compression

    May 8, 2026Jialin Yang, Jiankun Wang, Jiajun Wu +3CoT DistillationStructured Reasoning