Reasoning Errors

Momentum

6 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 47

All topics
CardsList
  1. Hallucination Across the Reasoning Lifecycle: Interface Visibility, Causal Evidence, and Release Control in Large Reasoning Models

    Oct 4, 2026Zhe Yu, Mohan Li, Lei Yu +6Reasoning Errors

  2. Interpreting Reasoning of Large Language Models via Partial Information Decomposition

    Sep 30, 2026Barproda Halder, Qiuyi Zhang, Sanghamitra DuttaLarge Reasoning ModelsReasoning Trajectory

  3. When Reasoning Goes Astray: Attention Dynamics of Uncontrolled Reasoning

    Sep 30, 2026Yuanhe Zhang, Ziwei Wang, Jie Ren +6Large Reasoning ModelsReasoning Errors

  4. Broadening Uncertainty Estimation for Audio Question Answering Across Methods, Formats, and Inputs

    Sep 24, 2026Aaron Isidore Grace, Weiran WangAudio UnderstandingSemantic Entropy

  5. TRACE: Learned Proprioceptive Odometry for Legged Robots under Unreliable Contact Conditions

    Aug 6, 2026Taehyeon Kong, Woojin Kim, Jemin HwangboOdometryProprioception

  6. Reasoning Errors Have a Region and a Direction in the Residual-Stream Trajectory of LLMs

    Aug 6, 2026Hamed Damirchi, Ignacio Meza De la Jara, Damith Ranasinghe +2Reasoning ErrorsReasoning Benchmark

  7. Network Information Enhances Unreliable News Domain Detection

    Aug 3, 2026Raphaela Keßler, Roman David Ventzke, Viola Priesemann +1Fake News DetectionHeadlines

  8. Latent Thought Credit: Multi-Answer Credit Assignment for Latent Reasoning

    Aug 3, 2026Xuyang Zhao, Liting Zhang, Zichen Xu +4Latent ThoughtsCredit Assignment

  9. Deep Interaction: An Efficient Human-AI Interaction Method for Large Reasoning Models

    Jul 15, 2026Hefeng Zhou, Jinxuan Zhang, Jiong Lou +4LLM Reasoning StrategiesLarge Reasoning Models

  10. Valid ≠\ne Necessary: Diagnosing Latent Inefficiency in Chain-of-Thought

    Jul 13, 2026Daeyeop Lee, Hwanjo YuReasoning ChainChain-of-Thought Reasoning

  11. Depth-Only Open-Vocabulary 3D Semantic Segmentation For Privacy-Preserving Robotic Applications

    Jul 1, 2026Xuying Huang, Sicong Pan, Maren BennewitzOpen-Vocabulary 3D SegmentationSemantic Segmentation

  12. The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans

    Jun 25, 2026Bella Fascendini, Kathryn McGregor, Max D. Gupta +1LLM Reasoning StrategiesReasoning Skills

  13. Learning from Your Own Mistakes: Constructing Learnable Micro-Reflective Trajectories for Self-Distillation

    Jun 17, 2026Zhilin Huang, Hang Gao, Ziqiang Dong +6Iterative Self-CorrectionReasoning Errors

  14. Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty

    Jun 15, 2026Baishali Chaudhury, Mengdie Flora Wang, Hyunji Hayley Park +3LLM Reasoning StrategiesReasoning Errors

  15. Temporal Backtracking Search for Test-time Generative Video Reasoning

    Jun 11, 2026Sejoon Jun, Zheng Ding, Huangyuan Su +2Interactive Video GenerationTest-Time Scaling

  16. Reasoning as Pattern Matching: Shared Mechanisms in Human and LLM Everyday Reasoning

    Jun 11, 2026Zach Studdiford, Gary LupyanLLM Reasoning StrategiesReasoning Errors

  17. DeMix: Debugging Training Data with Mixed Data Error Types by Investigating Influence Vectors

    Jun 10, 2026Jiale Deng, Yanyan Shen, Xiaogang Shi +1Training DataReasoning Errors

  18. Critic-Guided Heterogeneous Multi-Agent Reasoning for Reliable Mathematical Problem Solving

    Jun 4, 2026Muhammad Talha Sharif, Abdul RehmanMathematical ReasoningLLM Reasoning Strategies

  19. The Architecture of Errors: From Universal Impossibility to Patch-Local LLM Reliability

    May 28, 2026Mikhail L. Arbuzov, Lee Mosbacker, Sisong Bei +3Large Language Model ReliabilityLatent Failure Patterns

  20. Enhancing Factuality through Consensus and Consistency in Summarization Using Minimum Bayes Risk Decoding

    May 28, 2026Riza Setiawan Soetedjo, Yusuke Sakai, Hidetaka Kamigaito +3SummarizationFacts

  21. Beyond Imitation: Reflective On-Policy Self-Distillation for LLM Reasoning

    May 27, 2026Ziqi Zhao, Xinyu Ma, Liu Yang +6Unsupervised On-Policy Self-DistillationLLM Reasoning Strategies

  22. Readers make targeted regressions to plausible errors in reanalysis of "noisy-channel garden-path" sentences

    May 18, 2026Thomas Hikaru Clark, Roger Levy, Edward GibsonLinguisticsSyntactic Structure

  23. Confidence Geometry Reveals Trace-Level Correctness in Large Language Model Reasoning

    May 16, 2026Shuo Liu, Ding Liu, Shi-Ju RanLLM Reasoning StrategiesConfidence Estimation

  24. Cognitive-Uncertainty Guided Knowledge Distillation for Accurate Classification of Student Misconceptions

    May 14, 2026Qirui Liu, Hao Chen, Weijie Shi +2Student MisconceptionsKnowledge Distillation

  25. Teaching and Learning under Deductive Errors

    May 13, 2026Jan Arne Telle, Brigt Håvardstun, Jose Hernandez-OralloReasoning ErrorsFew-Shot Learning

  26. M2A: Synergizing Mathematical and Agentic Reasoning in Large Language Models

    May 11, 2026Junjian Wang, Xin Zhou, Qiran Xu +1Agentic ReasoningLLM Reasoning Strategies

  27. Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal

    May 10, 2026Aojie Yuan, Zhiyuan Julian Su, Haiyue Zhang +2Chain-of-Thought ReasoningReasoning Errors

  28. Robust Multi-Agent LLMs under Byzantine Faults

    May 9, 2026Haejoon Lee, Vincent-Daniel Yun, Dimitra Panagou +1Multi-Agent Large Language Model SystemsByzantine Attacks

  29. CECOR: Correction-oriented synthetic data construction for factual error correction

    May 4, 2026Lei Zhu, Xiaobao Wang, Jianbiao Yang +4Error CorrectionReasoning Errors

  30. Revisiting Non-Verbatim Memorization in Large Language Models: The Role of Entity Surface Forms

    Apr 23, 2026Yuto Nishida, Naoki Shikoda, Yosuke Kishinami +4MemorizationImplicit Association Test

  31. Catching The Correct Answer Trap: Characterising AI Tutor Blind Spots When Analysing Student Reasoning

    Apr 20, 2026Moiz Imran, Sahan BulathwelaReasoning ErrorsTutors

  32. Dual Strategies for Test-Time Adaptation

    Apr 19, 2026Nam Nguyen Phuong, Duc Nguyen The Minh, Phi Le Nguyen +2Stable Test-Time AdaptationTest-Time Adaptation

  33. From Benchmarking to Reasoning: A Dual-Aspect, Large-Scale Evaluation of LLMs on Vietnamese Legal Text

    Apr 17, 2026Van-Truong LeLegal Reasoning TasksReasoning Errors

  34. Can LLMs Model Incorrect Student Reasoning? A Case Study on Distractor Generation

    Mar 16, 2026Yanick Zengaffinen, Andreas Opedal, Donya Rooein +3Student MisconceptionsReasoning Errors

  35. Training Language Models to Use Prolog as a Tool

    Dec 8, 2025Niklas Mellgren, Peter Schneider-Kamp, Lukas Galke PoechLanguage ModelingTheorem Proving

  36. Critical or Compliant? The Double-Edged Sword of Reasoning in Chain-of-Thought Explanations

    Nov 15, 2025Eunkyu Park, Wesley Hanwen Deng, Vasudha Varadarajan +4Chain-of-Thought ReasoningReasoning Errors

  37. Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models

    Mar 31, 2025Rui Wang, Hongru Wang, Boyang Xue +9LLM Reasoning StrategiesReasoning Errors