Reasoning Trace Analysis

Momentum

4 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 106

All topics
CardsList
  1. Monitoring the Internal Monologue: Probe Trajectories Reveal Reasoning Dynamics

    May 18, 2026Maciej Chrabąszcz, Aleksander Szymczyk, Marcin Sendera +2Language Model Safety EvaluationLLM Interpretability

  2. Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries

    May 17, 2026Yanhang Li, Zhichao Fan, Zexin ZhuangMemorization in Language ModelsLLM Auditing

  3. Reasoning Models Don't Just Think Longer, They Move Differently

    May 14, 2026Anders Gjølbye, Lars Kai Hansen, Sanmi KoyejoLLM InterpretabilityRepresentation Geometry in Language Models

  4. SliceGraph: Mapping Process Isomers in Multi-Run Chain-of-Thought Reasoning

    May 14, 2026Kang Chen, Junjie Nian, Yixin Cao +1CoT ReasoningReasoning Trace Analysis

  5. STOP: Structured On-Policy Pruning of Long-Form Reasoning in Low-Data Regimes

    May 13, 2026Chenjun Xu, Zhennan Zhou, Zhan Su +3LLM PruningLLM Fine-Tuning

  6. GRACE: Gradient-aligned Reasoning Data Curation for Efficient Post-training

    May 13, 2026Junjie Li, Ziao Wang, NingXuan Ma +2Training Data SelectionLLM Post-Training

  7. When Reasoning Traces Become Performative: Step-Level Evidence that Chain-of-Thought Is an Imperfect Oversight Channel

    May 12, 2026Wenkai Li, Fan Yang, Ananya Hazarika +2CoT FaithfulnessLLM Auditing

  8. Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal

    May 10, 2026Aojie Yuan, Zhiyuan Julian Su, Haiyue Zhang +2LLM InterpretabilityCausal Interventions in Language Models

  9. Where Larger Models Excel: The Primacy of Constraint-Guided Reasoning

    May 9, 2026Guan-Yi Lin, Hen-Hsen HuangLanguage Model Scaling LawsLLM Reasoning

  10. Sanity Checks for Long-Form Hallucination Detection

    May 8, 2026Geigh Zollicoffer, Minh Vu, Hongli Zhan +2LLM EvaluationHallucination Detection

  11. Tracing Uncertainty in Language Model "Reasoning"

    May 8, 2026Nils Grünefeld, Bertram Højer, Philipp Mondorf +5LLM EvaluationCoT Reasoning

  12. Reliable Chain-of-Thought via Prefix Consistency

    May 8, 2026Naoto Iwase, Yuki Ichihara, Mohammad Atif Quamar +1Self-Consistency DecodingReasoning Consistency in Language Models

  13. Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts

    May 8, 2026Yi-Chang Chen, Feng-Ting Liao, Da-shan Shiu +1CoT ReasoningCausal Interventions in Language Models

  14. Measuring Black-Box Confidence via Reasoning Trajectories: Geometry, Coverage, and Verbalization

    May 7, 2026Marc Boubnovski Martell, Josefa Lia Stoisser, Kaspar Märtens +4Confidence Estimation in Language ModelsCoT Reasoning

  15. Correct Is Not Enough: Training Reasoning Planners with Executor-Grounded Rewards

    May 5, 2026Tianyang Han, Hengyu Shi, Junjie Hu +3RL for Code GenerationProcess Reward Models

  16. Measuring AI Reasoning: A Guide for Researchers

    May 4, 2026Munachiso Samuel Nwadike, Zangir Iklassov, Kareem Ali +2Reasoning EvaluationLLM Reasoning

  17. When Chain-of-Thought Fails, the Solution Hides in the Hidden States

    Apr 25, 2026Houman Mehrafarin, Amit Parekh, Ioannis KonstasTransformer InterpretabilityCoT Reasoning

  18. Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models

    Apr 25, 2026Max Hartman, Vidhata Jayaraman, Moulik Choraria +2CoT DistillationTeacher-Student Learning

  19. Large Language Models Decide Early and Explain Later

    Apr 24, 2026Ayan Datta, Zhixue Zhao, Bhuvanesh Verma +3Efficient Language Model ReasoningLLM Inference Acceleration

  20. Outcome Rewards Do Not Guarantee Verifiable or Causally Important Reasoning

    Apr 23, 2026Qinan Yu, Alexa Tartaglini, Peter Hase +2CoT FaithfulnessReinforcement Learning with Verifiable Rewards

  21. TRACES: Tagging Reasoning Steps for Adaptive Cost-Efficient Early-Stopping

    Apr 22, 2026Yannis Belkhiter, Seshu Tirupathi, Giulio Zizzo +1LLM Inference EfficiencyEarly Stopping

  22. How Do Answer Tokens Read Reasoning Traces? Self-Reading Patterns in Thinking LLMs for Quantitative Reasoning

    Apr 21, 2026Haoyang Chen, Yi Liu, Jianzhi Shao +3LLM InterpretabilityMathematical Reasoning

  23. How Much Thinking is Enough? Quantifying and Understanding Redundancy in LLM Reasoning

    Apr 21, 2026Zhiyuan Zhai, Xinkai You, Wenjing Yan +1LLM Inference EfficiencyRL for Language Model Reasoning

  24. When Safety Fails Before the Answer: Benchmarking Harmful Behavior Detection in Reasoning Chains

    Apr 21, 2026Ishita Kakkar, Enze Zhang, Rheeya Uppaal +1AI Safety EvaluationLLM Safety Evaluation