Language Model Distillation

Latest papers 350

All topics
CardsList
  1. Demystifying On-Policy Distillation: Roles, Pathologies, and Regulations

    Jul 15, 2026Rui Wang, Hongru Wang, Yi Chen +4RL for Language Model ReasoningLanguage Model Distillation

  2. EasyOPD: An Easy-to-use On-Policy Distillation Framework for Large Language Models

    Jul 13, 2026Jie Sun, Mao Zheng, Mingyang Song +7Cross-Tokenizer Knowledge DistillationLanguage Model Distillation

  3. SCOReD: Student-Aware CoT Optimization for Recommendation Distillation

    Jul 7, 2026Haz Sameen Shahgir, Yufei Li, Xiaohan Wei +8CoT DistillationLanguage Model Distillation

  4. CARD: Cross-component Audio Representation Distillation for Encoder-Free Audio Captioning

    Jul 6, 2026Ganesh Pavan Kartikeya Bharadwaj Kolluri, Yuchen Zhang, Michael Kampouridis +1Audio Representation LearningAudio-Language Models

  5. dOPSD: On-Policy Self-Distillation for Diffusion Language Models

    Jul 5, 2026Phuong Tuan Dat, Qi Li, Xinchao WangOn-Policy Self-DistillationLanguage Model Distillation

  6. SAD-LoRA: Spectral Alignment for Low-Rank Knowledge Distillation

    Jul 5, 2026Omer Tariq, Syed Muhammad Raza, Jeongbae SonLow-Rank AdaptationLow-Rank Compression

  7. Reward-Gated On-Policy Distillation

    Jul 4, 2026Mohammad Sadegh Akhondzadeh, Vijay Lingam, Atula Tejaswi +3Language Model DistillationOn-Policy Distillation

  8. Teacher Supervision over Representation Equivalence Classes

    Jul 3, 2026Sang Il HanRepresentation IdentifiabilityLanguage Model Distillation

  9. Distill Where the Student Goes: Teacher-Regularized RL for English-Evidence Cross-Lingual RAG

    Jul 3, 2026Haotian Zhou, Weiran Huang, Siqi Liu +3RL for Language ModelsRetrieval-Augmented Generation

  10. DemoPSD: Disagreement-Modulated Policy Self-Distillation

    Jul 2, 2026Yunhe Li, Hao Shi, Wenhao Liu +5On-Policy Self-DistillationRL for Language Model Reasoning

  11. Neuron-Aware Data Selection for Annotation-Free LLM Self-Distillation

    Jul 2, 2026Zhuowei Chen, Xiang Lorraine LiOn-Policy Self-DistillationTraining Data Selection

  12. Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation

    Jul 1, 2026Shayan Talaei, Abhinav Chinta, Devvrit Khatri +3LLM AuditingLanguage Model Distillation

  13. Self-conditioned Flow Map Language Models via Fixed-point Flows

    Jul 1, 2026Jaehoon Yoo, Wonjung Kim, Floor Eijkelboom +4Normalizing FlowsOne-Step Generative Modeling

  14. DOPD: Dual On-policy Distillation

    Jun 29, 2026Xinlei Yu, Gen Li, Qingyi Si +13On-Policy Self-DistillationVLM Distillation

  15. DRIFT: Difficulty Routing Self-DIstillation with Rhythm-Gated Exploration and Success BuFfer Training

    Jun 29, 2026Haisen Luo, Yiwei Liu, Haoning Wang +13Self-Training for Language ModelsRL for Language Model Reasoning

  16. Building Multi-Task Agentic LLMs via Two-Phase Distillation

    Jun 29, 2026Huaijie Wang, Shusheng Xu, Yi Wu +1Language Model DistillationMulti-Task RL

  17. ARKD: Adaptive Reinforcement Learning-Guided Bidirectional KL Divergence Distillation for Text Generation

    Jun 29, 2026Zilong Liu, Xuewen Zhang, Jinrui Xing +3Language Model DistillationKnowledge Distillation

  18. PHF: Privileged Hidden Flow for On-Policy Self-Distillation

    Jun 28, 2026Yuhan Li, Mingxu Zhang, Dazhong Shen +1On-Policy Self-DistillationLanguage Model Distillation

  19. On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity

    Jun 24, 2026Andrei Liviu Nicolicioiu, Mohammad Pezeshki, Aaron CourvilleOn-Policy Self-DistillationLanguage Model Distillation

  20. What Does It Mean to Break a Distillation Defense?

    Jun 23, 2026Lena Libon, Pura Peetathawatchai, Michael Aerni +2Model Extraction AttacksLLM Security

  21. Scaling Laws for Task-Specific LLM Distillation

    Jun 23, 2026Lavinia Ghita, Dhruv Desai, Ioana BoierLLM PruningLLM Compression

  22. The Verifier is the Curriculum: Execution-Gated Self-Distillation for Cross-Family Game Generation

    Jun 23, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1Execution-Guided Code GenerationLanguage Model Distillation

  23. AsyncOPD: How Stale Can On-Policy Distillation Be?

    Jun 23, 2026Wonjun Kang, Kevin Galim, Seunghyuk Oh +9Language Model DistillationOn-Policy Distillation

  24. Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning

    Jun 23, 2026Tianyuan Shi, Canbin Huang, Bei Li +4RL for Language Model ReasoningLanguage Model Distillation