Language Model Distillation

Latest papers 350

All topics
CardsList
  1. Poster: A Preliminary Study of LLM Distillation Inference

    Oct 8, 2026Edward Chen, Yuntao DuLLM AuditingLanguage Model Distillation

  2. DIAL-OPD: Learning More from Fewer Tokens in On-Policy Distillation

    Oct 8, 2026Anhao Zhao, Haoran Xin, Junlong Tong +5Language Model DistillationOn-Policy Distillation

  3. ReTeach: Building a Self-Teacher through Multi-Round Reflection and Retry

    Oct 8, 2026Yafeng Tang, Hao Li, Hongsheng Yu +1Language Model DistillationLLM Self-Refinement

  4. Why On-Policy Distillation Sometimes Fails: Vanishing Learning Signals

    Oct 8, 2026Lei Zhao, Qichao Zhao, Bowen Zuo +1On-Policy DistillationLanguage Model Distillation

  5. Distillation for Incrimination and Distillation for Capabilities

    Oct 7, 2026Sebastian Prasanna, Jacqueline Tay, Alek WestoverLLM Safety AlignmentLanguage Model Distillation

  6. KDFP: A first-principles approach to knowledge distillation in large language models

    Oct 7, 2026Ryan Swift, Konstantinos PsounisLanguage Model DistillationKnowledge Distillation

  7. SAPD: Step-Aligned Privileged Distillation

    Oct 7, 2026Tianle Wang, Jiayu Liu, Ruizhi Zhao +1LLM Post-TrainingLanguage Model Distillation

  8. From Probabilities to Decisions: Search and Multi-Teacher Distillation with Jev

    Oct 6, 2026Mohamad Yazan Sadoun, Sarah Sharif, Yaser Mike BanadLanguage Model DistillationMulti-Teacher Knowledge Distillation

  9. Socio-Foundation: A Model for Generalizable Individual Behavior Simulation via Hierarchical Capability Distillation

    Oct 6, 2026Liang Wang, Wenxuan Xie, Xinyi Mou +2Human Behavior SimulationLarge Language Model-Based Social Simulation

  10. UP-MOPD: Update Projection in Multi-Teacher On-Policy Distillation

    Oct 6, 2026Taojie Zhu, Jing Jin, Yuan Xia +8Language Model DistillationGradient Projection

  11. Learning What to Distill: Bilevel Top-K Token Selection for Self-Distillation in Large Language Models

    Oct 5, 2026Heng Liang, Xinwen Zhang, Hongchang GaoSelective Knowledge DistillationLanguage Model Distillation

  12. Learning What to Imitate: Entropy-Aware Distribution Mixing

    Oct 5, 2026Juan Garcia Giraldo, Matteo Santelmo, Eduard Durech +3Language Model DistillationUncertainty-Aware Knowledge Distillation

  13. From Gradients to Capabilities: Understanding Multi-Teacher On-Policy Distillation

    Oct 1, 2026Siqi Zhu, Suozhi Huang, Kaixuan Zhang +4Policy GradientLanguage Model Distillation

  14. Scaling and Distilling Text Embeddings for Better Diffusibility

    Oct 1, 2026Zekai Zhang, Yunjie Tian, Yanjin He +4Word EmbeddingsLanguage Model Distillation

  15. Distilling Directional Verification

    Oct 1, 2026Jungseob Lee, Sugyeong Eo, Seongtae Hong +4Question AnsweringLanguage Model Distillation

  16. Gumbel Straight Flow: Distilling Autoregressive Models into One-step Flow Maps

    Sep 30, 2026Yeongmin Kim, Arnaud Doucet, Andrew Campbell +3Non-Autoregressive Text GenerationOne-Step Generative Modeling

  17. PivotOPD: Learning to Recover from Pivotal Mistakes in Multi-Turn Agents

    Sep 30, 2026Yinghui He, Yapei Chang, Khushi Bhardwaj +4Language Model DistillationLLM Agent Training

  18. Revisiting On-policy Adversarial Black-Box Distillation: Calibrating Groupwise Reward Geometry for Effective Advantage Construction

    Sep 30, 2026Xiao Cui, Mo Zhu, Yulei Qin +3Group Relative Policy OptimizationLanguage Model Distillation

  19. Better Supervision Is Nearby: Neighborhood On-Policy Self-Distillation

    Sep 30, 2026Xincheng Wei, Yifan Ding, Yoshua Li +6On-Policy Self-DistillationMathematical Reasoning

  20. ReTaCo: Residual-Target Control for On-Policy Distillation

    Sep 30, 2026Zixiang Ni, Zhuo Hu, Renjie Cao +8Language Model DistillationOn-Policy Distillation

  21. QATFactory: A Versatile, Deployment-Aligned Framework for Quantization-aware Training and Distillation of LLMs

    Sep 30, 2026Weili Xu, Jisen Li, Yuqing Jian +8LLM QuantizationQuantization-Aware Training