LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework

    Jul 9, 2026Riccardo Revalor, Jalees Rehman, Debjit PalCoT FaithfulnessLLM Reasoning with Graphs

  2. From Voting to Agent Collaboration: Answer-Type-Aware LLM Pipelines for BioASQ 14b

    Jul 7, 2026Taeyun Roh, Eunha Lee, Wonjune Jang +3LLM Answer VerificationBiomedical QA

  3. Mechanism-level routing failure in LLMs over Lean-verified algebraic structures

    Jul 5, 2026Manuel Israel Cázares, Wenlin Zhang, Haobo MaLLM ReliabilityLLM Routing

  4. dOPSD: On-Policy Self-Distillation for Diffusion Language Models

    Jul 5, 2026Phuong Tuan Dat, Qi Li, Xinchao WangOn-Policy Self-DistillationLanguage Model Distillation

  5. Reward-Gated On-Policy Distillation

    Jul 4, 2026Mohammad Sadegh Akhondzadeh, Vijay Lingam, Atula Tejaswi +3Language Model DistillationOn-Policy Distillation

  6. Reading Between the Dots: Decoding Hidden Computation across Filler Tokens

    Jul 3, 2026Kaley Brauer, Claudio Mayrink Verdun, Samuel MarksLLM AuditingLLM Interpretability

  7. OmniLayout: A Schematic-Coupled Multimodal Benchmark for Constraint-Aware Geometric Reasoning in PCB Layout

    Jul 3, 2026Taiting Lu, Kaiyuan Lin, Mingjia Wang +12Electronic Design AutomationSpatial Reasoning

  8. CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning

    Jul 2, 2026Dingling Xu, Ruobing Wang, Qingfei Zhao +8LLM ReliabilityLLM Reasoning

  9. Purified OPSD: On-Policy Self-Distillation Without Losing How to Think

    Jul 2, 2026Zhanming Shen, Jintao Tong, Shaotian Yan +9CoT DistillationOn-Policy Self-Distillation

  10. TUDUM: A Turkish-Thinking Reasoning Pipeline for Qwen3.5-27B

    Jul 2, 2026Baran Bingol, Bahaeddin TurkogluLLM Fine-TuningLLM Mathematical Reasoning

  11. Geometric Signatures of Reasoning: A Spectral Perspective on Task Hardness

    Jul 2, 2026Aria Masoomi, Mahsa Bazzaz, Adel Javanmard +1LLM EvaluationRepresentation Geometry in Language Models

  12. IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

    Jul 1, 2026Samir Abdaljalil, Erchin Serpedin, Hasan KurbanLLM EvaluationScientific Reasoning

  13. Fork-Think with Confidence

    Jun 30, 2026Zena Al-Khalili, Rafi Hakim, Dietrich Klakow +1LLM Inference EfficiencyEfficient Language Model Reasoning

  14. Spatial Reasoning via Modality Switching Between Language and Symbolic Representations

    Jun 30, 2026Shreya Rajpal, Tanawan Premsri, Parisa KordjamshidiMultimodal GroundingMultimodal Reasoning

  15. BayesBench: Evaluating LLM Belief Trajectories Under Multi-Turn Evidence Accumulation

    Jun 29, 2026Ankur Samanta, Akshayaa Magesh, Tal Lancewicki +7LLM EvaluationBayesian Inference

  16. NeuReasoner: Theory-grounded Mapping of Reasoning Elicitation Boundaries

    Jun 29, 2026Aydin Javadov, Shyngys Aitkazinov, Tobias Hoesli +3Cognitive ModelingLLM Prompting

  17. HippoSpark: An On-Demand Experience System for LLM Reasoning

    Jun 29, 2026Jingyao Liu, Danling Meng, Chen Huang +5Retrieval-Augmented GenerationMemory-Augmented Language Models

  18. Why Struggle with Continuous Latents? Interpretable Discrete Latent Reasoning via Rendered Compression

    Jun 29, 2026Shuochen Chang, Qingyang Liu, Shaobo Wang +8LLM InterpretabilityEfficient Language Model Reasoning

  19. LLM-Guided Planning for Multi-hop Reasoning over Multimodal Nuclear Regulatory Documents

    Jun 28, 2026Mingyu Jeon, Bokyeong Kim, Suwan Cho +2Retrieval-Augmented GenerationLegal Document Analysis

  20. The Complexity Ceiling Benchmark: A Multi-Domain Evaluation of Sequential Reasoning Under Depth Scaling

    Jun 28, 2026Shubh Chapra, Dhruv Kumar, Murari Mandal +1LLM EvaluationStructured Reasoning

  21. ThinkProbe: Beyond Accuracy -- Structural Profiling of Open-Ended LLM Reasoning Traces via Non-Generative Thought Graphs

    Jun 27, 2026Mohamed Amine Kerkouri, Simon D. Hernandez, Marouane Tliba +3LLM Reasoning with GraphsStructured Reasoning

  22. Search for Truth from Reasoning: A Dynamic Representation Editing Framework for Steering LLM Trajectories

    Jun 26, 2026Tianlong Wang, Yuhang Wang, Weibin Liao +5Language Model SteeringRepresentation Geometry in Language Models

  23. The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans

    Jun 25, 2026Bella Fascendini, Kathryn McGregor, Max D. Gupta +1LLM EvaluationLLM Reasoning

  24. Einstein World Models

    Jun 25, 2026Munachiso Samuel Nwadike, Zangir Iklassov, Ali Mekky +2LLM Tool UseCounterfactual Reasoning

  25. Reasoning Quality Emerges Early: Data Curation for Reasoning Models

    Jun 25, 2026Hongyi Henry Jin, Wenhan Yang, Meysam Ghaffari +2LLM Fine-TuningTraining Data Selection