Language Model Distillation

Latest papers 350

All topics
CardsList
  1. Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization

    May 28, 2026Junlin He, Yihong Tang, Tong Nie +5LLM PruningLLM Compression

  2. Tailoring the Curriculum: Student-Centered Reasoning Distillation via Dynamic Data-Model Compatibility

    May 28, 2026Jiahao Huang, Fei Cheng, Junfeng Jiang +1Reasoning DistillationTraining Data Selection

  3. Apertus LLM Family Expansion via Distillation and Quantization

    May 27, 2026Andrei Panferov, Davit Melikidze, Martin Jaggi +1LLM QuantizationLLM Compression

  4. ADWIN: Adaptive Windows for Horizon-Aware On-Policy Distillation

    May 27, 2026Kun Liang, Chenming Tang, Clive Bai +3Language Model DistillationOn-Policy Distillation

  5. Context Distillation as Latent Memory Management

    May 27, 2026Ziyang Zheng, Zeju Li, Xiangyu Wen +5Memory-Augmented Language ModelsLanguage Model Distillation

  6. Beyond Imitation: Reflective On-Policy Self-Distillation for LLM Reasoning

    May 27, 2026Ziqi Zhao, Xinyu Ma, Liu Yang +6On-Policy Self-DistillationLanguage Model Distillation

  7. Gradient Transformer: Learning to Generate Updates for LLMs

    May 26, 2026Binh-Nguyen Nguyen, Khang Tran, NhatHai Phan +1Privacy-Preserving Language ModelsLLM Fine-Tuning

  8. Not All Tokens Matter Equally: Dynamic In-context Vector Distillation with Decisive-Token Supervision for Long-form Medical Report Generation

    May 26, 2026Ning Wu, Rui Liu, Xinkun Lin +5Medical Report GenerationLong-Form Document Generation

  9. MAIGO: Mitigating Lost-in-Conversation with History-Cleaned On-Policy Self-Distillation

    May 26, 2026Haoyu Zheng, Yun Zhu, Shu Yuan +5Instruction FollowingData Contamination in Language Models

  10. Less is More: Early Stopping Rollout for On-Policy Distillation

    May 26, 2026Zhou Ziheng, Jiaqi Li, Huacong Tang +2Language Model DistillationOn-Policy Distillation

  11. When the Strongest Teacher Is Not the Best Teacher: Student-Centric Answer Selection

    May 26, 2026Zhengyu Hu, Zheyuan Xiao, Linxin Song +10Language Model DistillationLLM Post-Training

  12. Not All Disagreement Is Learnable: Token Teachability in On-Policy Distillation

    May 26, 2026Yuanyi Wang, Su Lu, Yanggan Gu +6Selective Knowledge DistillationLanguage Model Distillation

  13. EmoDistill: Offline Emotion Skill Distillation for Language Model Agents in Adversarial Negotiation

    May 26, 2026Yunbo Long, Haolang Zhao, Lukas Beckenbauer +2Multi-Agent NegotiationAutomated Negotiation

  14. The Bridge-Garden Dilemma in LLM Distillation: Why Mixing Hard and Soft Labels Works

    May 25, 2026Guanghui Wang, Kaiwen Lv Kacuila, Zhiyong Yang +5LLM CompressionLanguage Model Distillation

  15. Extreme Region Policy Distillation

    May 25, 2026Changyu Chen, Xiting Wang, Rui YanKL-Regularized RLRL for Language Model Reasoning

  16. Decision-Making with Lightweight Confidence-Aware Language Model for Autonomous Driving

    May 25, 2026Ruoyu Yao, Ruiguo Zhong, Pei Liu +3Confidence Estimation in Language ModelsLanguage Model Distillation

  17. The Distillation Game: Adaptive Evaluations & Efficient Defenses

    May 21, 2026Youssef Allouah, Mahdi Haghifam, Sanmi Koyejo +1Model Extraction AttacksAdversarial Attacks

  18. Self-Policy Distillation via Capability-Selective Subspace Projection

    May 21, 2026Guangya Hao, Yitong Shang, Yunbo Long +2Self-Training for Language ModelsLanguage Model Distillation

  19. X-Token: Projection-Guided Cross-Tokenizer Knowledge Distillation

    May 20, 2026Sharath Turuvekere Sreenivas, Adithyakrishna Venkatesh Hanasoge, Mingyu Yang +4Cross-Tokenizer Knowledge DistillationLanguage Model Distillation

  20. When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning

    May 20, 2026Xiaogeng Liu, Xinyan Wang, Yingzi Ma +2CoT DistillationOn-Policy Self-Distillation

  21. AVSD: Adaptive-View Self-Distillation by Balancing Consensus and Teacher-Specific Privileged Signals

    May 20, 2026Duy Nguyen, Hanqi Xiao, Archiki Prasad +7On-Policy Self-DistillationLanguage Model Distillation

  22. Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation

    May 19, 2026Bing Wang, Shaotian Yan, Chen Shen +7CoT DistillationLanguage Model Distillation

  23. AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignment

    May 18, 2026Zhenlin Wei, Pu Jian, Yingzhuo Deng +6Token-Level Credit AssignmentRL for Language Model Reasoning

  24. FedSDR: Federated Self-Distillation with Rectification

    May 18, 2026Ziheng Ren, Zhanming Shen, Hao Wang +2LLM Fine-TuningHallucination in Language Models

  25. Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation

    May 15, 2026Shuaiyi Li, Zhisong Zhang, Yan Wang +5Long-Context ModelingLLM Inference Acceleration