LLM Reasoning

LLM: Large Language Model

Momentum

68 papers in the last four weeks, up 143% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 650

All topics
CardsList
  1. CHASE: Cache-Hole-Adapted Skip Exit for Looped State-Space Language Models

    Jul 11, 2026Zhenxuan Yu, Takeshi Kojima, Yutaka Matsuo +1Efficient Language Model InferenceLLM Reasoning

  2. Silent Failures in Quantized LLM Reasoning: A Taxonomy-Based Analysis of Hollow Convergence and Failure Mode Shifts

    Jul 10, 2026Renuka Oladri, Mohan Vamsi Varadaraju Priya, Jerry WuLLM QuantizationLLM Evaluation

  3. Concretized Proposition Prompting Resolves Composition-Knowledge Dichotomy in Large Language Models

    Jul 9, 2026Changhun Lee, Minguk Jeon, Jongkyung Shin +1Compositional ReasoningLLM Prompting

  4. Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework

    Jul 9, 2026Riccardo Revalor, Jalees Rehman, Debjit PalCoT FaithfulnessLLM Reasoning with Graphs

  5. From Voting to Agent Collaboration: Answer-Type-Aware LLM Pipelines for BioASQ 14b

    Jul 7, 2026Taeyun Roh, Eunha Lee, Wonjune Jang +3LLM Answer VerificationBiomedical QA

  6. Mechanism-level routing failure in LLMs over Lean-verified algebraic structures

    Jul 5, 2026Manuel Israel Cázares, Wenlin Zhang, Haobo MaLLM ReliabilityLLM Routing

  7. dOPSD: On-Policy Self-Distillation for Diffusion Language Models

    Jul 5, 2026Phuong Tuan Dat, Qi Li, Xinchao WangOn-Policy Self-DistillationLanguage Model Distillation

  8. Reward-Gated On-Policy Distillation

    Jul 4, 2026Mohammad Sadegh Akhondzadeh, Vijay Lingam, Atula Tejaswi +3Language Model DistillationOn-Policy Distillation

  9. Reading Between the Dots: Decoding Hidden Computation across Filler Tokens

    Jul 3, 2026Kaley Brauer, Claudio Mayrink Verdun, Samuel MarksLLM AuditingLLM Interpretability

  10. OmniLayout: A Schematic-Coupled Multimodal Benchmark for Constraint-Aware Geometric Reasoning in PCB Layout

    Jul 3, 2026Taiting Lu, Kaiyuan Lin, Mingjia Wang +12Electronic Design AutomationSpatial Reasoning

  11. CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning

    Jul 2, 2026Dingling Xu, Ruobing Wang, Qingfei Zhao +8LLM ReliabilityLLM Reasoning

  12. Purified OPSD: On-Policy Self-Distillation Without Losing How to Think

    Jul 2, 2026Zhanming Shen, Jintao Tong, Shaotian Yan +9CoT DistillationOn-Policy Self-Distillation

  13. TUDUM: A Turkish-Thinking Reasoning Pipeline for Qwen3.5-27B

    Jul 2, 2026Baran Bingol, Bahaeddin TurkogluLLM Fine-TuningLLM Mathematical Reasoning

  14. Geometric Signatures of Reasoning: A Spectral Perspective on Task Hardness

    Jul 2, 2026Aria Masoomi, Mahsa Bazzaz, Adel Javanmard +1LLM EvaluationRepresentation Geometry in Language Models

  15. IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

    Jul 1, 2026Samir Abdaljalil, Erchin Serpedin, Hasan KurbanLLM EvaluationScientific Reasoning

  16. Fork-Think with Confidence

    Jun 30, 2026Zena Al-Khalili, Rafi Hakim, Dietrich Klakow +1LLM Inference EfficiencyEfficient Language Model Reasoning

  17. Spatial Reasoning via Modality Switching Between Language and Symbolic Representations

    Jun 30, 2026Shreya Rajpal, Tanawan Premsri, Parisa KordjamshidiMultimodal GroundingMultimodal Reasoning

  18. BayesBench: Evaluating LLM Belief Trajectories Under Multi-Turn Evidence Accumulation

    Jun 29, 2026Ankur Samanta, Akshayaa Magesh, Tal Lancewicki +7LLM EvaluationBayesian Inference

  19. NeuReasoner: Theory-grounded Mapping of Reasoning Elicitation Boundaries

    Jun 29, 2026Aydin Javadov, Shyngys Aitkazinov, Tobias Hoesli +3Cognitive ModelingLLM Prompting

  20. HippoSpark: An On-Demand Experience System for LLM Reasoning

    Jun 29, 2026Jingyao Liu, Danling Meng, Chen Huang +5Retrieval-Augmented GenerationMemory-Augmented Language Models

  21. Why Struggle with Continuous Latents? Interpretable Discrete Latent Reasoning via Rendered Compression

    Jun 29, 2026Shuochen Chang, Qingyang Liu, Shaobo Wang +8LLM InterpretabilityEfficient Language Model Reasoning

  22. LLM-Guided Planning for Multi-hop Reasoning over Multimodal Nuclear Regulatory Documents

    Jun 28, 2026Mingyu Jeon, Bokyeong Kim, Suwan Cho +2Retrieval-Augmented GenerationLegal Document Analysis

  23. The Complexity Ceiling Benchmark: A Multi-Domain Evaluation of Sequential Reasoning Under Depth Scaling

    Jun 28, 2026Shubh Chapra, Dhruv Kumar, Murari Mandal +1LLM EvaluationStructured Reasoning

  24. ThinkProbe: Beyond Accuracy -- Structural Profiling of Open-Ended LLM Reasoning Traces via Non-Generative Thought Graphs

    Jun 27, 2026Mohamed Amine Kerkouri, Simon D. Hernandez, Marouane Tliba +3LLM Reasoning with GraphsStructured Reasoning