Effective Distillation

Latest papers 20

All topics
CardsList
  1. AHMAD: Adaptive Hybrid Multi-task Vision Learning with Assisted Distillation for Keypoint Detection

    Sep 28, 2026Mohammad Mahdi, Nedyalko Prisadnikov, Yuqian Fu +3Multi--Task LearningKeypoint Detection

  2. On-Policy or Off-Policy Learning? A Systematic Study of Distillation Dynamics

    Sep 28, 2026Julianna Piskorz, Antonin Berthon, Mihaela van der SchaarOff-Policy LearningOn-Policy

  3. AnyStep-WAM: Budget-Aligned Distillation and Adaptive Inference for World Action Models

    Sep 27, 2026Rui Wang, Xiangyu Wang, Donglin Yang +4Recent World-Action ModelsFaster-Wam

  4. Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation

    Jul 1, 2026Shayan Talaei, Abhinav Chinta, Devvrit Khatri +3Large Language Model BiasBiases

  5. SATB-VR: Training Few-Step Video Restoration Diffusion Model using SNR-Aware Trajectory Blending

    Jun 27, 2026Haoran Bai, Xiaoxu Chen, Xiaoyu Liu +4Video RestorationIterative Denoising Methods

  6. RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting

    May 29, 2026Yuduo Li, Xiaofeng Shi, Qian Kou +2Supervised FinetuningDataset Distillation

  7. When the Strongest Teacher Is Not the Best Teacher: Student-Centric Answer Selection

    May 26, 2026Zhengyu Hu, Zheyuan Xiao, Linxin Song +10TeacherEffective Distillation

  8. Fast Image Super-Resolution via Consistency Rectified Flow

    May 12, 2026Jiaqi Xu, Wenbo Li, Haoze Sun +8Real-World Image Super-ResolutionGenerative Super-Resolution

  9. Federated Language Models Under Bandwidth Budgets: Distillation Rates and Conformal Coverage

    May 11, 2026Prasanjit Dubey, Xiaoming HuoFederated LearningProbe-Logit Distillation

  10. Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

    May 8, 2026Amin Karimi Monsefi, Dominic Culver, Nikhil Bhendawade +3Conditional Flow MatchingFew-Step Distillation

  11. Learned Neighbor Trust for Collaborative Deployment in Model-Agnostic Decentralized Learning

    May 6, 2026Michael Lanier, Luise Ge, Sastry Kompella +1Log-Ratio-Based Gaussian Trust WeightDecentralized Learning

  12. Deep Reprogramming Distillation for Medical Foundation Models

    May 6, 2026Siyuan Du, Yuhang Zhou, Haolin Li +5Knowledge DistillationWireless Foundation Models

  13. Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models

    Apr 25, 2026Max Hartman, Vidhata Jayaraman, Moulik Choraria +2Effective DistillationReasoning Traces

  14. Distillation Traps and Guards: A Calibration Knob for LLM Distillability

    Apr 21, 2026Weixiao Zhan, Yongcheng Jing, Leszek Rutkowski +1Knowledge DistillationDataset Distillation

  15. When Perplexity Lies: Generation-Focused Distillation of Hybrid Sequence Models

    Mar 27, 2026Juan Gabriel Kostelec, Qinghai GuoEffective DistillationSymbolic Distillation

  16. Effective Distillation to Hybrid xLSTM Architectures

    Mar 16, 2026Lukas Hauzenberger, Niklas Schmidinger, Thomas Schmied +7Probe-Logit DistillationEffective Distillation

  17. TimeWarp: Evaluating Web Agents by Revisiting the Past

    Mar 5, 2026Md Farhan Ishmam, Kenneth MarinoWeb AgentsAgentic Benchmarks

  18. When Distillation Breaks Motion Control: Restoring Generative Trajectories for Fast Video Generators

    Jun 24, 2025Jintao Rong, Xin Xie, Xinyi Yu +4Student-Generated TrajectoriesEffective Distillation