Reasoning Trace Analysis

Momentum

4 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 106

All topics
CardsList
  1. Decodable but Not Faithful: Coupling Natural-Language Rationales to Programmatic Verifiers

    Jun 19, 2026Vatsal Ananthula, Adarsh KumarappanFaithfulness of Language Model ExplanationsLLM Auditing

  2. From Brewing to Resolution: Tracing the Internal Lifecycle of Code Reasoning in LLMs

    Jun 16, 2026Siyue Chen, Yifu Guo, Yuquan Lu +9LLM InterpretabilityCode Language Models

  3. GRACE: Step-Level Benchmark for Faithful Reasoning over Context

    Jun 15, 2026Hoang Pham, Dong Le, Anh Tuan LuuCoT FaithfulnessContextual Faithfulness

  4. Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation

    Jun 13, 2026Xian Sun, Wei Gao, Yingshuo Wang +9Language Model Generation EvaluationCoT Evaluation

  5. Beyond the Commitment Boundary: Probing Epiphenomenal Chain-of-Thought in Large Reasoning Models

    Jun 11, 2026Daniel Scalena, Sara Candussio, Luca Bortolussi +3CoT FaithfulnessLLM Interpretability

  6. MARS: Margin-Adversarial Risk-controlled Stopping for Parallel LLM Test-time Scaling

    Jun 11, 2026Wenbo Chen, Puheng Li, Mengyang Liu +2LLM Inference EfficiencySelf-Consistency Decoding

  7. RecurGuard: Runtime Monitoring for Reasoning-Token Consumption Attacks

    Jun 6, 2026Abid Aziz, Hafsa Binte KibriaAdversarial Attacks on LLMsLLM Security

  8. A Comprehensive Anatomy of Human and DeepSeek-R1 LLM Mathematical Reasoning

    Jun 5, 2026Yuxiang Chen, Jun WangCoT ReasoningStructured Reasoning

  9. Self-Commitment Latency: A Reward-Free Probe for Prompted Implicit Hacking

    Jun 4, 2026Bonan Shen, Youting Wang, Dingyan Shang +1Reward HackingLanguage Model Probing

  10. Inducing Reasoning Primitives from Agent Traces

    Jun 2, 2026Zhihan Lei, Jiarui Yan, Joshua Momo +1LLM Agent Skill LearningAgentic Reasoning

  11. Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models

    Jun 1, 2026Simone Caldarella, Davide Talon, Rahaf Aljundi +2LLM EvaluationOverthinking in Language Models

  12. Unveiling the Entropy Dynamics of Chain-of-Thought Reasoning

    Jun 1, 2026Ting Xu, Xu He, Yupu Lu +4CoT ReasoningTest-Time Scaling

  13. Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs

    May 30, 2026Yu-An Lu, Ci-Yang Tsai, Yu-Lin Tsai +2LLM PromptingPrivacy Leakage in Language Models

  14. Conformal Certification of Reasoning Trace Prefixes

    May 28, 2026Matt Y. Cheung, Ashok Veeraraghavan, Hanjie Chen +1Conformal PredictionLanguage Model Calibration

  15. TRACE: Toulmin-based Reasoning Assessment through Constructive Elements for LLM CoT Evaluation

    May 28, 2026Yundong Kim, Heyoung YangLLM EvaluationLanguage Model Generation Evaluation

  16. Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces

    May 28, 2026Chen He, Yuhao Wu, Lei Wang +2Fine-TuningLLM Fine-Tuning

  17. ReasonOps: Operator Segmentation for LLM Reasoning Traces

    May 28, 2026Daniel Lee, Owen Queen, James ZouCoT EvaluationCoT Reasoning

  18. Reasoning that Travels: Dissecting How Chain-of-Thought Transfers Across Models

    May 27, 2026Xinyuan Cheng, Beiduo Chen, Philipp Mondorf +1LLM PromptingLLM Reasoning

  19. CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

    May 27, 2026Linas Nasvytis, Simon Jerome Han, Ben Prystawski +3LLM Self-RefinementEfficient Language Model Reasoning

  20. The Shape of Overthinking: Backtracking Bursts in Long Reasoning Traces

    May 27, 2026Navid Rezazadeh, Arash Gholami DavoodiReasoning EvaluationEfficient Language Model Inference

  21. GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought

    May 26, 2026Weijiang Lv, Wentong Zhao, Jiayu Wang +3CoT FaithfulnessRL for Language Model Reasoning

  22. Beyond a Single Direction: Chain-of-Thought Disrupts Simple Steering of Refusal

    May 26, 2026Kia-Jüng Yang, Dominik Meier, Jiachen Zhao +2CoT ReasoningLLM Refusal Behavior

  23. Explaining Too Much? Understanding How Large Language Model Reasoning Traces Influence Performance and Metacognition

    May 25, 2026Daniela Fernandes, Daniel Buschek, Lev Tankelevitch +2CoT ReasoningHuman-AI Interaction

  24. Detecting Unfaithful Chain-of-Thought via Circuit-Guided Internal-External Discrepancy

    May 25, 2026Xu Shen, Zhen Tan, Song Wang +4CoT FaithfulnessLLM Auditing

  25. Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning

    May 22, 2026Jinghan Jia, Joe Benton, Eric EasleyCoT FaithfulnessLLM Interpretability

  26. PathCal: State-Aware Reflection-Marker Calibration for Efficient Reasoning

    May 21, 2026Lingyu Jiang, Zirui Li, Shuo Xing +6Efficient Language Model ReasoningEfficient Language Model Inference

  27. Reasoning-Trace Collapse: Evaluating the Loss of Explicit Reasoning During Fine-Tuning

    May 20, 2026Lukas Twist, Helen Yannakoudakis, Jie M. ZhangSupervised Fine-TuningReasoning Evaluation