Reasoning Distillation

Momentum

3 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 14

All topics
CardsList
  1. Solving Without Stopping: On-Policy Distillation at Small Scale

    Sep 29, 2026Hongyang Li, Yiming Zhu, Xiao Li +3Reasoning DistillationSmall Language Models

  2. ChemOPD: Multi-Teacher On-Policy Distillation for Multi-Task Chemical Reasoning

    Sep 27, 2026Yaoyao Xu, Xinjian Zhao, Xiaozhuang Song +2Reasoning DistillationMulti-Teacher Knowledge Distillation

  3. TeacherGRPO: Closing the Capacity Gap in Reasoning Distillation via Teacher Alignment

    Sep 27, 2026Zhenyu Lei, Zihan Chen, Yaochen Zhu +5Reasoning DistillationRL for Language Model Reasoning

  4. Benchmarking and Reasoning Distillation of Large Language Models for Feedback Controller Design in Complex Dynamical Systems

    Aug 7, 2026Zhongchao Zhou, Yixuan Xie, Wenwei Yu +5LLM EvaluationLanguage Model-Based Control

  5. Distilling Reasoning Traces into Advisory Prompts for Software Engineering Tasks

    Aug 1, 2026Faizan Faisal, Prem Devanbu, Toufique AhmedReasoning DistillationLLM Prompting

  6. DT-Guard: Intent-Driven Reasoning-Active Training for Reasoning-Free LLM Safety Guardrail

    Jul 7, 2026He Liu, Changtao Miao, Xinjie Yang +12Reasoning DistillationLLM Guardrails

  7. Z-Reward: Beyond Scalar Rewards by Internalizing Reasoning into Score Distributions

    Jun 8, 2026Xin Jin, Huanqia Cai, Zhen Li +9Reward ModelingReasoning Distillation

  8. Tailoring the Curriculum: Student-Centered Reasoning Distillation via Dynamic Data-Model Compatibility

    May 28, 2026Jiahao Huang, Fei Cheng, Junfeng Jiang +1Reasoning DistillationTraining Data Selection

  9. Decoupling KL and Trajectories: A Unified Perspective for SFT, DAgger, Offline RL, and OPD in LLM Distillation

    May 16, 2026Anhao Zhao, Haoran Xin, Yingqi Fan +3Reasoning DistillationOn-Policy Distillation

  10. Curriculum Learning-Guided Progressive Distillation in Large Language Models

    May 11, 2026Jincheng Cao, Fanzhi Zeng, Leqi Liu +1Reasoning DistillationLanguage Model Distillation

  11. ReflectMT: Internalizing Reflection for Efficient and High-Quality Machine Translation

    Apr 21, 2026Kunquan Li, Yingxue Zhang, Fandong Meng +1Reasoning DistillationMachine Translation

  12. Revisiting the Capacity Gap in Chain-of-Thought Distillation from a Practical Perspective

    Apr 10, 2026Tokio Kajitsuka, Ukyo Honda, Sho TakaseCoT DistillationReasoning Distillation

  13. Less Data Approximates More: Earning Faithful Confidence in High-Stakes Domains

    Apr 9, 2026Haokai Ma, Lee Yan Zhen, Gang Yang +4RL for Language ModelsReinforcement Learning