Language Model Distillation

Latest papers 350

All topics
CardsList
  1. UniSD: Towards a Unified Self-Distillation Framework for Large Language Models

    May 7, 2026Yiqiao Jin, Yiyang Wang, Lucheng Fu +7Language Model DistillationSelf-Distillation

  2. Asymmetric On-Policy Distillation: Bridging Exploitation and Imitation at the Token Level

    May 7, 2026Nan Jia, Haojin Yang, Xing Ma +6RL for Language Model ReasoningLanguage Model Distillation

  3. Estimating the Black-box LLM Uncertainty with Distribution-Aligned Adversarial Distillation

    May 7, 2026Huizi Cui, Huan Ma, Qilin Wang +2Language Model DistillationLLM Uncertainty Estimation

  4. Preference-Based Self-Distillation: Beyond KL Matching via Reward Regularization

    May 6, 2026Xin Yu, Liuchen Liao, Yiwen Zhang +3On-Policy Self-DistillationLanguage Model Distillation

  5. Power Distribution Bridges Sampling, Self-Reward RL, and Self-Distillation

    May 6, 2026Akiyoshi Tomihari, Issei SatoReinforcement LearningKL-Regularized RL

  6. Distilling Bayesian Belief States into Language Models for Auditable Negotiation

    May 6, 2026Zongqi Cui, Baihan LinMulti-Agent NegotiationOpponent Modeling

  7. Budgeted LoRA: Distillation as Structured Compute Allocation for Efficient Inference

    May 5, 2026Mohammed Sabry, Anya BelzLLM CompressionLow-Rank Adaptation

  8. Uni-OPD: Unifying On-Policy Distillation with a Dual-Perspective Recipe

    May 5, 2026Wenjin Hou, Shangpin Peng, Weinong Wang +13Language Model DistillationMulti-Teacher Knowledge Distillation

  9. A Unified Approach to Interpreting Knowledge Distillation for Large Language Models via Interactions

    May 5, 2026Qingzhuo Wang, Ruiyang Qin, Zhenxin Qin +2Feature Interaction ModelingLLM Interpretability

  10. SHIELD: A Diverse Clinical Note Dataset and Distilled Small Language Models for Enterprise-Scale De-identification

    May 5, 2026Jose D. Posada, David Love, Somalee Datta +1HealthcareClinical Information Extraction

  11. Standing on the Shoulders of Giants: Stabilized Knowledge Distillation for Cross--Language Code Clone Detection

    May 4, 2026Mohamad Khajezade, Fatemeh H. Fard, Mohamed Sami ShehataLanguage Model DistillationKnowledge Distillation

  12. Multilingual Safety Alignment via Self-Distillation

    May 3, 2026Ruiyang Qin, Qingzhuo Wang, Dongrui Liu +3Multilingual Language ModelsLLM Safety Alignment

  13. EGAD: Entropy-Guided Adaptive Distillation for Token-Level Knowledge Transfer

    May 3, 2026Hao Zhang, Zhibin Zhang, Guangxin Wu +3LLM CompressionLanguage Model Distillation

  14. MTA: Multi-Granular Trajectory Alignment for Large Language Model Distillation

    May 2, 2026Pham Khanh Chi, Quoc Phong Dao, Thuat Nguyen +3Representation LearningLanguage Model Distillation

  15. SRA: Span Representation Alignment for Large Language Model Distillation

    May 2, 2026Quoc Phong Dao, Hoang Son Nguyen, Pham Khanh Chi +4Cross-Tokenizer Knowledge DistillationLanguage Model Distillation

  16. LEAP: Layer-wise Exit-Aware Pretraining for Efficient Transformer Inference

    May 1, 2026Shashank Kapadia, Deep Naryan Mishra, Sujal Reddy Alugubelli +4Efficient Transformer InferenceDynamic Neural Networks

  17. Select to Think: Unlocking SLM Potential with Local Sufficiency

    Apr 29, 2026Wenxuan Ye, Yangyang Zhang, Xueli An +2Small Language ModelsEfficient Language Model Reasoning

  18. TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents

    Apr 27, 2026Jiaqi Wang, Wenhao Zhang, Weijie Shi +2Language Model DistillationLLM Agents

  19. LegalDrill: Diagnosis-Driven Synthesis for Legal Reasoning in Small Language Models

    Apr 26, 2026Tianchun Li, Haochen Liu, Vishwa Pardeshi +5Synthetic Data GenerationSmall Language Models

  20. Pre-trained LLMs Meet Sequential Recommenders: Efficient User-Centric Knowledge Distillation

    Apr 23, 2026Nikita Severin, Danil Kartushov, Vladislav Urzhumov +8Sequential RecommendationLanguage Model Distillation

  21. Hybrid Policy Distillation for LLMs

    Apr 22, 2026Wenhong Zhu, Ruobing Xie, Rui Wang +1Language Model DistillationOn-Policy Distillation

  22. SCURank: Ranking Multiple Candidate Summaries with Summary Content Units for Enhanced Summarization

    Apr 21, 2026Bo-Jyun Wang, Ying-Jia Lin, Hung-Yu KaoLearning to RankText Summarization

  23. Distillation Traps and Guards: A Calibration Knob for LLM Distillability

    Apr 21, 2026Weixiao Zhan, Yongcheng Jing, Leszek Rutkowski +1Language Model CalibrationLanguage Model Distillation