Language Model Distillation

Latest papers 350

All topics
CardsList
  1. PRIDE: Privileged Information-enhanced Distillation for Empathetic Dialogue Generation

    Jun 22, 2026Jiaqiang Wu, Zhouan Zhu, Shangfei WangLanguage Model DistillationLearning Using Privileged Information

  2. ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation

    Jun 22, 2026Chen Lin, Kedi Chen, Wei ZhangCoT DistillationLanguage Model Distillation

  3. Understanding Knowledge Distillation in Post-Training: When It Helps and When It Fails

    Jun 22, 2026Xin Liu, Simin Ma, Shujian Liu +5Data-Free Knowledge DistillationLanguage Model Distillation

  4. On the Position Bias of On-Policy Distillation

    Jun 21, 2026Yan Xie, Sijie Zhu, Tiansheng Wen +2Importance WeightingLanguage Model Distillation

  5. Context-Aware Distillation and Ablation for Text2DSL

    Jun 21, 2026Alexander V. Kozachok, Alexander M. Nazimov, Shamil G. MagomedovLLM PromptingLLM-Based Program Synthesis

  6. Weight-Space Geometry of Offline Reasoning Training

    Jun 21, 2026Aleksandr Nikolich, Igor Kiselev, Vladimir Platonov +1RL for Language ModelsDirect Preference Optimization

  7. Channel Location Constrains the Auditability of Subliminal Learning

    Jun 20, 2026Tamas MadlSubliminal LearningLanguage Model Distillation

  8. Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts

    Jun 20, 2026Qingfei Zhao, Huan Song, Shuyu Tian +2Trajectory GenerationCoT Distillation

  9. TALAS: Teacher-Anchored Layer Alignment with Adaptive Sharpness-Aware Minimization for Embedding Distillation

    Jun 20, 2026Quoc Phong Dao, Hoang Son Nguyen, Pham Khanh Chi +4LLM CompressionLanguage Model Distillation

  10. Masked Self-Distillation: Internalizing the Chain-of-Thought in Language Models

    Jun 18, 2026Durgesh Kalwar, Vardhan Palod, Jaya Adithya Pavuluri +1CoT DistillationEfficient Language Model Reasoning

  11. Marginal Advantage Accumulation for Memory-Driven Agent Self-Evolution

    Jun 18, 2026Mingyu Yang, Keye Zheng, Congchao Cheng +4Language Model DistillationKnowledge Distillation

  12. Efficient Financial Language Understanding via Distillation with Synthetic Data

    Jun 17, 2026Wen-Fong, Huang, Edwin SimpsonFinancial Sentiment AnalysisLanguage Model Distillation

  13. Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

    Jun 15, 2026Zhongzhu Zhou, Qingyang Wu, Junxiong Wang +4Neural Network InitializationLinear Attention

  14. The Quality-Utility Paradox: Why High-Reward Data Impairs Small Model Mathematical Reasoning

    Jun 15, 2026Haolong Qian, Xianliang Yang, Yinuo ma +6CoT DistillationLanguage Model Distillation

  15. On-Policy Distillation with Curriculum Turn-level Guidance for Multi-turn Agents

    Jun 14, 2026Gengsheng Li, Mao Zheng, Mingyang Song +8Language Model DistillationLLM Agent Training

  16. SHARD: Safe and Helpful Alignment via Self-Reframing Distillation

    Jun 14, 2026Viswonathan Manoranjan, Amogh Gupta, Anvesh Rao Vijjini +2LLM Safety AlignmentLanguage Model Distillation

  17. RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation

    Jun 10, 2026Leyi Pan, Shuchang Tao, Yunpeng Zhai +5RL for Language Model ReasoningLanguage Model Distillation

  18. AuRA: Internalizing Audio Understanding into LLMs as LoRA

    Jun 9, 2026Bo Cheng, Lei Shi, Zhanyu Ma +5Spoken Language UnderstandingAudio Understanding

  19. K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling

    Jun 9, 2026Zhiwei Tang, Yuanyu He, Yizheng Han +4LLM ServingLanguage Model Decoding

  20. ParaBridge: Bridging Paralinguistic Perception and Dialogue Behavior in Speech Language Models

    Jun 9, 2026Yuxiang Wang, Qinke Ni, Shengbo Cai +3On-Policy Self-DistillationSpoken Dialogue Systems

  21. Quantifying Subliminal Behavioral Transfer Ratios in Language Model Distillation

    Jun 9, 2026Uwe König, Hamza Kazmi, Ruizhe Li +1Subliminal LearningLanguage Model Distillation

  22. Breaking the Tokenizer Barrier: On-Policy Distillation across Model Families

    Jun 8, 2026Yifan Niu, Han Xiao, Dongyi Liu +4Cross-Tokenizer Knowledge DistillationLanguage Model Distillation