CoT Distillation

CoT: Chain-of-Thought

Latest papers 57

All topics
CardsList
  1. Learning from Think-Mode Advantage via On-Policy Distillation

    Sep 29, 2026Wanqi Ren, Jianxiang Wang, Danxuan Liu +2CoT DistillationLanguage Model Distillation

  2. Distilling Visual Reasoning into Text Space

    Sep 28, 2026Wenhan Yang, Nilay Naharas, Ali Payani +1CoT DistillationVLM Distillation

  3. Efficient Reasoning Distillation: Small Video-Language Models via Synthetic CoT and Difficulty-Aware Fine-Tuning

    Sep 14, 2026Mantek Singh, Jeshwanth Challagundla, Siddharth Raina +1CoT DistillationVLM Distillation

  4. MI-Distillation: Selecting from Model-Interpolated Instruct-Reasoning Data Spectrum for Chain-of-Thought Distillation

    Aug 30, 2026Yangsong Lan, Renkai Hu, HongKai Zheng +4CoT DistillationLanguage Model Distillation

  5. Simple-OPD: Demystifying Warm-up for On-policy Distillation

    Aug 7, 2026Tao Liu, Taiqiang Wu, Mao Zheng +5CoT DistillationOn-Policy Distillation

  6. TabRank: Chain-of-Thought Distillation for Table Re-Rankers

    Jul 28, 2026Adarsh Singh, Kushal Raj Bhandari, Jianxi Gao +2Table QACoT Distillation

  7. DAIS: Dependency-Aware Intermediate QA Supervision for Complex Reasoning

    Jul 21, 2026Yu Wang, Ming Fan, Xicheng Zhang +5CoT Distillation

  8. Better Starts, Better Ends: Bootstrapped Iterative Self-Reasoning Distillation for Compressed Reasoning

    Jul 17, 2026Leichao Dong, Dongxu Zhang, Yiding Sun +4CoT DistillationEfficient Language Model Reasoning

  9. Answer-Conditioned Chains of Thought Degrade Verifiable-Reasoning Distillation in Large Language Models

    Jul 16, 2026Jungseob Lee, Seungyoon Lee, Suhyune Son +4CoT DistillationLanguage Model Distillation

  10. SCOReD: Student-Aware CoT Optimization for Recommendation Distillation

    Jul 7, 2026Haz Sameen Shahgir, Yufei Li, Xiaohan Wei +8CoT DistillationLanguage Model Distillation

  11. Purified OPSD: On-Policy Self-Distillation Without Losing How to Think

    Jul 2, 2026Zhanming Shen, Jintao Tong, Shaotian Yan +9CoT DistillationOn-Policy Self-Distillation

  12. Knowledge Distillation from Large Reasoning Models to Compact Student Models: A Case Study on the John O Bryan Mathematics Competition

    Jun 30, 2026Gaurab Baral, Aaditya Khanal, Yangyang Tao +1CoT DistillationMathematical Reasoning

  13. ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation

    Jun 22, 2026Chen Lin, Kedi Chen, Wei ZhangCoT DistillationLanguage Model Distillation

  14. Finding the Evidence: Discovering Decision-Supporting Tokens for On-Policy Reasoning Distillation

    Jun 22, 2026Jinwei Xiao, Zhuowen Han, Yueqing Sun +6CoT DistillationOn-Policy Distillation

  15. Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts

    Jun 20, 2026Qingfei Zhao, Huan Song, Shuyu Tian +2Trajectory GenerationCoT Distillation

  16. When Compression Helps and When It Hurts: Condition-Aware Analysis of Chain-of-Thought Distillation

    Jun 19, 2026Siyang Lyu, Xinghao Chen, Zhijing Sun +3Model CompressionCoT Distillation

  17. Masked Self-Distillation: Internalizing the Chain-of-Thought in Language Models

    Jun 18, 2026Durgesh Kalwar, Vardhan Palod, Jaya Adithya Pavuluri +1CoT DistillationEfficient Language Model Reasoning

  18. Learning from Your Own Mistakes: Constructing Learnable Micro-Reflective Trajectories for Self-Distillation

    Jun 17, 2026Zhilin Huang, Hang Gao, Ziqiang Dong +6LLM Self-CorrectionCoT Distillation

  19. The Quality-Utility Paradox: Why High-Reward Data Impairs Small Model Mathematical Reasoning

    Jun 15, 2026Haolong Qian, Xianliang Yang, Yinuo ma +6CoT DistillationLanguage Model Distillation

  20. Characterize Then Distill: Mechanistic Reasoning in Large Output Spaces

    Jun 5, 2026Debjyoti Saha RoyMulti-Label ClassificationCoT Distillation

  21. Compress-Distill: Reasoning Trace Compression for Efficient Knowledge Distillation

    Jun 4, 2026Maxime Griot, Paul Steven Scotti, Tanishq Mathew AbrahamCoT DistillationTeacher-Student Learning

  22. LoRi: Low-Rank Distillation for Implicit Reasoning

    Jun 3, 2026Ryan Solgi, Jiayi Tian, Zheng ZhangCoT DistillationMathematical Reasoning

  23. Invariant Gradient Alignment for Robust Reasoning Distillation

    Jun 3, 2026Zehua Cheng, Wei Dai, Jiahao SunCoT DistillationDomain Generalization

  24. Distilling Neuro-Symbolic Programs into 3D Multi-modal LLMs

    May 31, 2026Wentao Mo, Yang LiuCoT Distillation3D Spatial Reasoning

  25. Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Distillation

    May 29, 2026Yanjiang Liu, Jie Lou, Xinyan Guan +7CoT DistillationLanguage Model Distillation

  26. LARK: Learnability-Grounded Trajectory Selection for Efficient Reasoning Distillation

    May 28, 2026Tianrun Yu, Kaixiang Zhao, Chih-Chun Chen +5CoT DistillationLanguage Model Distillation

  27. Better Accuracies, Worse Reasoning: A Step-Level Audit of Medical Chain-of-Thought Distillation

    May 27, 2026Zhaoyang Jiang, Xuanqi Peng, Fei Teng +5CoT DistillationCoT Evaluation

  28. Generative Spatiotemporal Intent Sequence Recommendation via Implicit Reasoning in Amap

    May 27, 2026Sicong Wang, Ruiting Dong, Yue Liu +7Spatiotemporal ReasoningCoT Distillation

  29. When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning

    May 20, 2026Xiaogeng Liu, Xinyan Wang, Yingzi Ma +2CoT DistillationOn-Policy Self-Distillation

  30. Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation

    May 19, 2026Bing Wang, Shaotian Yan, Chen Shen +7CoT DistillationLanguage Model Distillation

  31. Distribution Corrected Offline Data Distillation for Large Language Models

    May 13, 2026Yumeng Zhang, Zhengbang Yang, Yevin Nikhel Goonatilake +1CoT DistillationEfficient Language Model Reasoning

  32. GateKD: Confidence-Gated Closed-Loop Distillation for Robust Reasoning

    May 13, 2026Kasidit Sermsri, Teerapong PanboonyuenCoT DistillationLanguage Model Distillation

  33. On-Policy Distillation with Best-of-N Teacher Rollout Selection

    May 10, 2026Ke Zhang, Yunjie Tian, Dongdi Zhao +4CoT DistillationBest-of-N Sampling

  34. LiteMedCoT-VL: Parameter-Efficient Adaptation for Medical Visual Question Answering

    May 10, 2026Runze Ma, Shunbo Jia, Haonan Lyu +2CoT DistillationHealthcare

  35. Structural Rationale Distillation via Reasoning Space Compression

    May 8, 2026Jialin Yang, Jiankun Wang, Jiajun Wu +3CoT DistillationStructured Reasoning

  36. Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models

    Apr 25, 2026Max Hartman, Vidhata Jayaraman, Moulik Choraria +2CoT DistillationTeacher-Student Learning

  37. Improving Reasoning Capabilities in Small Models through Mixture-of-Layers Distillation with Stepwise Attention on Key Information

    Apr 17, 2026Yao Chen, Jiawei Sheng, Wenyuan Zhang +1CoT DistillationSmall Language Models

  38. Revisiting the Capacity Gap in Chain-of-Thought Distillation from a Practical Perspective

    Apr 10, 2026Tokio Kajitsuka, Ukyo Honda, Sho TakaseCoT DistillationReasoning Distillation

  39. Grounded Chess Reasoning in Language Models via Master Distillation

    Mar 20, 2026Zhenwei Tang, Qianfeng Wen, Seth Grief-Albert +4LLM GroundingCoT Distillation

  40. HEAL: Hindsight Entropy-Assisted Learning for Reasoning Distillation

    Mar 11, 2026Wenjing Zhang, Jiangze Yan, Jieyun Huang +7CoT DistillationLanguage Model Distillation

  41. Measuring and Mitigating Post-hoc Rationalization in Reverse Chain-of-Thought Generation

    Feb 16, 2026Guangyue Peng, Zongchao Chen, Wen Luo +9CoT DistillationCoT Reasoning

  42. BRIDGE: Bridging Reasoning In Distillation Gap Elimination via Structure-Aware Masking

    Feb 5, 2026Bowen Yu, Sheng Zhang, Binhao Wang +8CoT DistillationMathematical Reasoning

  43. Distilling LLM Reasoning into Graph of Concept Predictors

    Feb 3, 2026Ziyang Yu, Liang ZhaoCoT DistillationActive Learning

  44. Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation

    Dec 24, 2025Wei-Rui Chen, Vignesh Kothapalli, Ata Fatahibaarzi +5CoT DistillationSelective Knowledge Distillation

  45. From Hindsight to Foresight: Self-Encouraged Hindsight Distillation for Knowledge-based Visual Question Answering

    Nov 14, 2025Yu Zhao, Ying Zhang, Xuhui Sui +4Visual Question AnsweringCoT Distillation

  46. Scale or Reason? A Compute-Equivalent Analysis of Reasoning Distillation

    Sep 26, 2025Nicolas Boizard, Hippolyte Gisserot-Boukhlef, Kevin El Haddad +2CoT DistillationLLM Fine-Tuning

  47. Beyond Scaling Law: A Data-Efficient Distillation Framework for Reasoning

    Aug 13, 2025Xiaojun Wu, Xiaoguang Jiang, Huiyang Li +11CoT DistillationLanguage Model Distillation