LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Search for Truth from Reasoning: A Dynamic Representation Editing Framework for Steering LLM Trajectories

    Jun 26, 2026Tianlong Wang, Yuhang Wang, Weibin Liao +5Language Model SteeringRepresentation Geometry in Language Models

  2. The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans

    Jun 25, 2026Bella Fascendini, Kathryn McGregor, Max D. Gupta +1LLM EvaluationLLM Reasoning

  3. Einstein World Models

    Jun 25, 2026Munachiso Samuel Nwadike, Zangir Iklassov, Ali Mekky +2LLM Tool UseCounterfactual Reasoning

  4. Reasoning Quality Emerges Early: Data Curation for Reasoning Models

    Jun 25, 2026Hongyi Henry Jin, Wenhan Yang, Meysam Ghaffari +2LLM Fine-TuningTraining Data Selection

  5. Data-driven Machine Learning Cannot Reach Symbolic-level Logical Reasoning -- The Limit of the Scaling Law

    Jun 24, 2026Tiansi Dong, Mateja Jamnik, Pietro LiòLogical ReasoningSymbolic Reasoning

  6. Learning with a Single Rollout via Monte Carlo Pass@k Critic

    Jun 24, 2026Fengdi Che, Yang Liu, Lei Yu +4RL for Language Model ReasoningCredit Assignment in RL

  7. CLOSER-VLN: Closed-Loop Self-Verified Retrieval-Augmented Reasoning for Aerial Vision-Language Navigation

    Jun 24, 2026Shaoxuan Li, Xiangyu Dong, Xiaoguang Ma +3UAV NavigationVision-Language Navigation

  8. Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing

    Jun 24, 2026Yutong Yin, Mingyu Jin, Jin Pan +12RL for Language Model ReasoningTest-Time Scaling

  9. ScaleToT: Generalizing Structured LLM Reasoning for Billion-Scale Low-Activity User Modeling

    Jun 23, 2026Tianbao Ma, Chang Xi, Yichuan Zou +7User ModelingLLM Reasoning

  10. VeryTrace: Verifying Reasoning Traces through Compilable Formalism and Structured Verification

    Jun 23, 2026Ninghan Zhong, Ahmet Ege Tanriverdi, Kaan Kale +1Formal VerificationStructured Reasoning

  11. Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning

    Jun 23, 2026Tianyuan Shi, Canbin Huang, Bei Li +4RL for Language Model ReasoningLanguage Model Distillation

  12. Scheduling Thoughts: Learning the Order of Thought in Diffusion Language Models

    Jun 22, 2026Jiawei Xu, Minghui Liu, Aakriti Agrawal +2Masked Diffusion ModelsLanguage Model Decoding

  13. HOLMES: Evaluating Higher-Order Logical Reasoning in LLMs

    Jun 22, 2026Yucheng Wu, Jundong Xu, Mingzhen Ju +4Logical ReasoningLLM Evaluation

  14. ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation

    Jun 22, 2026Chen Lin, Kedi Chen, Wei ZhangCoT DistillationLanguage Model Distillation

  15. Finding the Evidence: Discovering Decision-Supporting Tokens for On-Policy Reasoning Distillation

    Jun 22, 2026Jinwei Xiao, Zhuowen Han, Yueqing Sun +6CoT DistillationOn-Policy Distillation

  16. Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

    Jun 20, 2026Xuanming Zhang, Sining Zhoubian, Yuxuan Chen +8LLM AlignmentLanguage Model Decoding

  17. ForEx: A Formal Verification Framework for Explainable Reasoning in Logical Fallacy Detection and Annotation

    Jun 20, 2026Pei-Cing Huang, Chienyu Liu, Chan Hsu +3Logical ReasoningExplainability Evaluation

  18. Decodable but Not Faithful: Coupling Natural-Language Rationales to Programmatic Verifiers

    Jun 19, 2026Vatsal Ananthula, Adarsh KumarappanFaithfulness of Language Model ExplanationsLLM Auditing

  19. LLM and Human Modes of Representation

    Jun 19, 2026Shalom LappinLLM EvaluationLLM Reasoning

  20. Depth-Entropy Guided Sampling for Training-Free LLM Reasoning

    Jun 19, 2026Zibin Meng, Peng Xie, Kani ChenLLM InferenceTest-Time Scaling

  21. Coherence Under Commitment: Probing Generalization and Vacuous Memorization in LLM Logical Reasoning

    Jun 19, 2026Noor Islam S. Mohammad, Mahmudul HasanLLM EvaluationReasoning Consistency in Language Models

  22. QMFOL: Benchmarking Large Language Model Reasoning via Quantifiable Monadic First-Order Logic Test Case Generation

    Jun 18, 2026Xinyi Zheng, Ling Shi, Tianlong Yu +3Logical ReasoningLLM Evaluation

  23. CARE: Competence-Aware Reward Shaping for Adaptive Reasoning Length in Video-MLLMs

    Jun 18, 2026Chengwen Liu, Hao Peng, Jisheng Dang +3Reward ShapingVideo Reasoning

  24. CombEval: A Framework for Evaluating Combinatorial Counting in Large Language Models

    Jun 18, 2026Yuxu Zhou, Ondřej Kuželka, Yuyi Wang +2LLM EvaluationLLM Reasoning

  25. Analyzing the Narration Gap in LLM-Solver Loops

    Jun 17, 2026Zunchen Huang, Songgaojun DengAdversarial Attacks on LLMsFormal Verification

  26. Learning from Your Own Mistakes: Constructing Learnable Micro-Reflective Trajectories for Self-Distillation

    Jun 17, 2026Zhilin Huang, Hang Gao, Ziqiang Dong +6LLM Self-CorrectionCoT Distillation