Language Model Distillation

Latest papers 350

All topics
CardsList
  1. Distribution Corrected Offline Data Distillation for Large Language Models

    May 13, 2026Yumeng Zhang, Zhengbang Yang, Yevin Nikhel Goonatilake +1CoT DistillationEfficient Language Model Reasoning

  2. Towards Resource-Efficient LLMs: End-to-End Energy Accounting of Distillation Pipelines

    May 13, 2026Katherine Lambert, Sasha LuccioniEnergy-Efficient MLLanguage Model Distillation

  3. Prefix Teach, Suffix Fade: Local Teachability Collapse in Strong-to-Weak On-Policy Distillation

    May 13, 2026Kaiyuan Liu, Ziyuan Zhuang, Yang Bai +3Selective Knowledge DistillationLanguage Model Distillation

  4. Teacher-Guided Policy Optimization for On-Policy Reasoning Distillation under Large Policy Divergence

    May 13, 2026Xinyu Liu, Kechen Jiao, Chunyang Xiao +10RL for Language Model ReasoningPolicy Optimization

  5. GateKD: Confidence-Gated Closed-Loop Distillation for Robust Reasoning

    May 13, 2026Kasidit Sermsri, Teerapong PanboonyuenCoT DistillationLanguage Model Distillation

  6. Multi-Rollout On-Policy Distillation via Peer Successes and Failures

    May 12, 2026Weichen Yu, Xiaomin Li, Yizhou Zhao +8RL for Language Model ReasoningLanguage Model Distillation

  7. OmniThoughtVis: A Scalable Distillation Pipeline for Deployable Multimodal Reasoning Models

    May 12, 2026Yuanhao Yue, Chengyu Wang, Yuanjie Lyu +2VLM DistillationMultimodal Reasoning

  8. SOMA: Efficient Multi-turn LLM Serving via Small Language Model

    May 11, 2026Xueqi Cheng, Qiong Wu, Zhengyi Zhou +3LLM ServingSmall Language Models

  9. ReAD: Reinforcement-Guided Capability Distillation for Large Language Models

    May 11, 2026Xueqi Cheng, Xugui Zhou, Tyler Derr +1LLM CompressionLanguage Model Distillation

  10. Curriculum Learning-Guided Progressive Distillation in Large Language Models

    May 11, 2026Jincheng Cao, Fanzhi Zeng, Leqi Liu +1Reasoning DistillationLanguage Model Distillation

  11. On-Policy Distillation with Best-of-N Teacher Rollout Selection

    May 10, 2026Ke Zhang, Yunjie Tian, Dongdi Zhao +4CoT DistillationBest-of-N Sampling

  12. Crosslingual On-Policy Self-Distillation for Multilingual Reasoning

    May 10, 2026Yihong Liu, Raoyuan Zhao, Michael A. Hedderich +1On-Policy Self-DistillationCross-Lingual Reasoning in Language Models

  13. Test-Time Speculation

    May 10, 2026Avinash Kumar, Sujay Sanghavi, Poulami DasTest-Time AdaptationTest-Time Optimization

  14. Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation

    May 10, 2026Yuxuan Jiang, Runchao Li, Shubhashis Roy Dipta +2Language Model DistillationOn-Policy Distillation

  15. Reasoning Compression with Mixed-Policy Distillation

    May 9, 2026Han Yang, Mingyan Wu, Bailan He +4Language Model DistillationEfficient Language Model Inference

  16. Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

    May 8, 2026Amin Karimi Monsefi, Dominic Culver, Nikhil Bhendawade +3Flow MatchingDiffusion Language Model Inference

  17. KL for a KL: On-Policy Distillation with Control Variate Baseline

    May 8, 2026Minjae Oh, Sangjun Song, Gyubin Choi +2Language Model DistillationPolicy Gradient Methods

  18. Prune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon Reasoning

    May 8, 2026Zhicheng Yang, Zhijiang Guo, Yifan Song +5RL for Language Model ReasoningLanguage Model Distillation

  19. Chain-based Distillation for Effective Initialization of Variable-Sized Small Language Models

    May 8, 2026Boyu Shi, YiCheng Jiang, Chang Liu +3Small Language ModelsCross-Architecture Knowledge Distillation

  20. SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation

    May 8, 2026Jie Sun, Mao Zheng, Mingyang Song +6Cross-Tokenizer Knowledge DistillationLanguage Model Distillation

  21. Rubric-based On-policy Distillation

    May 8, 2026Junfeng Fang, Zhepei Hong, Mao Zheng +7LLM AlignmentLanguage Model Distillation