CoT Faithfulness

CoT: Chain-of-Thought

Momentum

5 papers in the last four weeks, up 67% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 54

All topics
CardsList
  1. From Concept Alignment to Causal Grounding: An Intervention Test of Chain-of-Thought Faithfulness

    Sep 19, 2026Qianli Wang, Yilong Wang, Dennis Wei +5CoT FaithfulnessLLM Interpretability

  2. Legibility is Not Interpretability: Comparing Judged and Actual Importance in Chain-Of-Thought Reasoning

    Sep 3, 2026Kevin Du, Alexander Hoyle, Laura Ruis +1CoT FaithfulnessProcess Reward Models

  3. Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered

    Aug 29, 2026Aryo Pradipta Gema, Neel Rajani, Rohit Saxena +2CoT FaithfulnessLLM Auditing

  4. FaithformBench: Benchmarking Faithfulness of Mathematical Chain-of-Thought Autoformalisation

    Aug 11, 2026Rob Cornish, Iacopo Ghinassi, Po-Hung Yeh +7CoT FaithfulnessLLM Sycophancy

  5. SymDiag: Explainable Diagnosis for LLM Reasoning via Neuro-Symbolic Verification

    Aug 9, 2026Wenyao Cui, Huaping Zhang, Yongyi Huang +6CoT FaithfulnessLLM Answer Verification

  6. Risky Business: Measuring The Faithfulness-Safety Tension

    Aug 4, 2026Dominik Meier, Luca Joshua Francis, Marco Bernhard Kaiser +3CoT FaithfulnessLanguage Model Safety Evaluation

  7. Does Accuracy Equal Evidence? Reasoning Faithfulness under KV Cache Compression

    Aug 3, 2026Mengting Ai, Jingrui He, Yue GuoCoT FaithfulnessReasoning Evaluation

  8. TRACE-TS: Attribution-Grounded and Traceable Sensor-Language Reasoning for Human Activity Understanding

    Jul 31, 2026Sparsh Rastogi, Tanmay Kumar, Baiyu Chen +3CoT FaithfulnessHuman Activity Recognition

  9. On the Generalization of Steering Vectors for Chain-of-Thought Faithfulness

    Jul 31, 2026Matthew Nguyen, Kyle Cox, Austin Meek +1CoT FaithfulnessLanguage Model Steering

  10. A Reference-Free Score for Detecting Silent Reasoning Failures in Large Language Models

    Jul 28, 2026Vivek Shukla, Varun Shukla, Atul +2CoT FaithfulnessMathematical Reasoning Benchmarks

  11. Two Regimes of Chain-of-Thought Unfaithfulness: Behavioral Detection Fails Where Models Are Wrong

    Jul 26, 2026Suramya R. Angdembay, Dikshant Aryal, Nick RahimiCoT FaithfulnessCoT Evaluation

  12. Not All LLM Reasoning is Visible in the Chain-of-Thought

    Jul 24, 2026Vatsal Baherwani, Tom Goldstein, Ashwinee PandaCoT FaithfulnessLLM Interpretability

  13. Chemical Chain-of-Thought Functions as a Hallucination-Prone Molecular Scratchpad

    Jul 23, 2026Jiatong Li, Yuxuan Ren, Weida Wang +2CoT FaithfulnessScientific Reasoning

  14. CASE: Causal Alignment and Structural Enforcement for Improving Chain-of-Thought Faithfulness

    Jul 21, 2026Ziming Wang, Yinghua Yao, Changwu Huang +2CoT FaithfulnessFaithfulness of Language Model Explanations

  15. From Plausible to Actionable: A Position on LLM Self-Explanations

    Jul 17, 2026Elize Herrewijnen, Benedetta Muscato, Gizem Gezici +1CoT FaithfulnessFaithfulness of Language Model Explanations

  16. Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework

    Jul 9, 2026Riccardo Revalor, Jalees Rehman, Debjit PalCoT FaithfulnessLLM Reasoning with Graphs

  17. Final Checkpoints Are Not Enough: Analyzing Latent Reasoning Faithfulness Along Training Trajectories

    Jul 7, 2026Hengyu Jin, Shu Yang, Di WangCoT FaithfulnessContinuous Latent Reasoning

  18. Detecting Answer-Driven Reasoning in LLM-Based Educational Tutors via Truncated Chain-of-Thought Auditing

    Jul 6, 2026Bonan Shen, Dingyan Shang, Youting Wang +1CoT FaithfulnessIntelligent Tutoring Systems

  19. Do Models Read What They Write? Causal Registers in Scratchpad Reasoning

    Jun 28, 2026Benjamin Shih, John Winnicki, Eric DarveCoT FaithfulnessCoT Reasoning

  20. To Reason or to Fabricate: Reasoning Without Shortcuts via Hint-Anchored Pairwise Aggregation

    Jun 28, 2026Jiuheng Lin, Chen Zhang, Yansong FengCoT FaithfulnessReward Modeling

  21. GRACE: Step-Level Benchmark for Faithful Reasoning over Context

    Jun 15, 2026Hoang Pham, Dong Le, Anh Tuan LuuCoT FaithfulnessContextual Faithfulness

  22. Beyond the Commitment Boundary: Probing Epiphenomenal Chain-of-Thought in Large Reasoning Models

    Jun 11, 2026Daniel Scalena, Sara Candussio, Luca Bortolussi +3CoT FaithfulnessLLM Interpretability