Knowledge Distillation

Latest papers 196

All topics
CardsList
  1. Distilling Directional Verification

    Oct 1, 2026Jungseob Lee, Sugyeong Eo, Seongtae Hong +4Knowledge DistillationFew-Step Distillation

  2. MCD: Causal Distillation of Multimodal In-Context Learning in Large Vision-Language Models

    Sep 30, 2026Yanshu Li, Jiaqian Li, Canran Xiao +3Multimodal Large Language ModelsKnowledge Distillation

  3. Learning Beyond Full Imitation: Task-Preserving Knowledge Distillation

    Sep 30, 2026Qianfeng Yuan, Wenbing TaoKnowledge DistillationKullback-Leibler Divergence

  4. K2P: Label-Free Knowledge to Prompt Distillation

    Sep 30, 2026Yingchuan Zhang, Haoran Lu, Wenxuan Zhong +1Knowledge DistillationTeacher

  5. Distilling Agentic Systems: A Roadmap across Models, Artifacts, and Harnesses

    Sep 29, 2026Ziluowen Luo, Senzhang Wang, Chaozhuo Li +9Knowledge DistillationProduction Agentic Systems

  6. From UNI2-h to ConvNeXt-T: Lightweight Nuclei Instance Segmentation via Knowledge Distillation

    Sep 28, 2026Wenyan LiConvnextVision Transformer

  7. When Less Data Favors Smaller Teachers: Rethinking Teacher Capacity and Data Selection for Knowledge Distillation

    Sep 28, 2026Minjae Park, Taesun Yeom, Jaeho LeeKnowledge DistillationTeacher

  8. Distilling Visual Reasoning into Text Space

    Sep 28, 2026Wenhan Yang, Nilay Naharas, Ali Payani +1Recent Vision-Language ModelsMultimodal Reasoning Benchmarks

  9. A Statistical Perspective on Knowledge Distillation: Foundations, Classical Methods, and Large Language Model Extensions

    Sep 27, 2026Luyang Fang, Haoran Lu, Jiazhang Cai +4Knowledge DistillationResidual Distillation

  10. Ladders of Thought: A Self-Evolving Curriculum of Progressively Simplified Reasoning Traces

    Sep 22, 2026Minghui Liu, Thomas Magelinski, Dehao Yuan +2LLM Reasoning StrategiesThoughts

  11. Transferring Visual Explanations: How Cross-Architecture Knowledge Distillation Affects Model Interpretability

    Sep 20, 2026Aleks Czufarow, Ihor BabinKnowledge DistillationInterpretability

  12. Enhanced Knowledge Distillation for Detection Transformer via Teacher Prediction Refinement

    Sep 17, 2026Yitong Xing, Yuhao Cheng, Yanping Li +1Rt-DetrDetection Transformer

  13. Personalized Federated Learning through Global Knowledge Distillation and Local Head Adaptation

    Sep 15, 2026Polycarpo Souza Neto, José Mairton Barros da Silva Júnior, Charles Casimiro CavalcanteFederated LearningKnowledge Distillation

  14. Multimodal Emergency Vehicle Classification via Audio-Visual Transformers and Knowledge Distillation

    Sep 15, 2026Vijay John, Amar DabajaAutomotive DetectionMultimodal Classification

  15. Label-Guided Knowledge Distillation for 3D-CNNs in Action Recognition

    Sep 14, 2026Yanjiang Shi, Peng Zhao, Nan Qi +1Knowledge DistillationStudent

  16. ALRA: Adaptive Local Relational Alignment for Logit-Based Pre-training Distillation of Autoregressive Language Models

    Sep 3, 2026Quang Hoang Trung, Quang Huu Hieu, Nguyen Van Hoang Phuc +1Dataset DistillationKnowledge Distillation

  17. Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning Network

    Sep 1, 2026Lucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4Knowledge DistillationGossip

  18. Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall

    Sep 1, 2026Jacqueline He, Howard Yen, Shuyue Stella Li +9Knowledge DistillationTeacher

  19. ACTD: Anchor-Based Cross-Tokenizer Distillation with Residual Regularization

    Aug 30, 2026Huiyi Zhang, Zijian Li, Xiaocheng Feng +4Teacher-Student DistillationKnowledge Distillation

  20. SPEAR: Distilling Domain-Adaptive Reasoning Skeletons via Sequential Symbolic Alignment in Reinforcement Learning

    Aug 27, 2026Zhuochun Li, Yuelyu Ji, Yiming Zeng +1Process Reward ModelKnowledge Distillation

  21. RT-SEMamba: Real-Time Speech Enhancement Mamba via Progressive Knowledge Distillation

    Aug 12, 2026Rong Chao, Sung-Feng Huang, Moreno La Quatra +4Speech EnhancementMamba-Based Models

  22. Benchmarking Trustworthiness of SLMs: Pre-trained vs. Compressed

    Aug 12, 2026Haokun Lin, Kaijie Zhu, Haobo Xu +4Small Large Language ModelsLarge Language Model Reliability

  23. Distillation of Foundation Models for Time-dependent PDEs

    Aug 12, 2026Daniel Musekamp, Boshra Ariguib, Andrei Manolache +1Autoregressive RolloutKnowledge Distillation

  24. Anti-Shortcut Distillation via Temporal Negative Knowledge Transfer

    Aug 12, 2026Syed Muhammad Raza, Omer Tariq, Jeongbae SonKnowledge DistillationSymbolic Distillation

  25. Grid-Preserving Knowledge Distillation: Transferring Convolutional Inductive Bias to Vision Transformers under Data Scarcity

    Aug 11, 2026Junyong Choi, Cheolhyeon Park, Jaehoon ChoVision TransformerKnowledge Distillation

  26. UniDFKD: A Unified Semantic Prior Framework for Architecture-Agnostic Data-Free Knowledge Distillation

    Aug 10, 2026Xuewan He, Tong Chu, Zihan Cheng +5Knowledge Distillation

  27. A Controlled Study of Feature-Based Knowledge Distillation Across Student Designs

    Aug 8, 2026Abhinand Balachandran, Praveen PrashantKnowledge DistillationResnet-18

  28. STEMMA: An Adversarial Multi-Agent Framework for Evaluating Self-Identity Consistency in LLMs

    Aug 8, 2026Nuthakki Siva Gopala Krishna, Kanishka JainKnowledge DistillationAdversarial Prompts

  29. NeuroGuard: Neural Gradient Update Aware of Representation Damage

    Aug 8, 2026Taigo Sakai, Kazuhito HottaClass-Incremental LearningBalanced Learning

  30. FedTransKD-IDS: Robust Federated Transfer Learning with Knowledge Distillation for Intrusion Detection in IoT

    Aug 6, 2026Mohammad Hosssein Gholamrezazadeh, Ahmadreza MontazerolghaemAhmadreza MontazerolghaemFederated LearningInternet Of Thing

  31. Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation

    Aug 4, 2026Quoc Cuong Ninh, Huy Xuan Pham, Anh Tung Nguyen +13D Object DetectionVoxel

  32. Channel-wise Dynamic Knowledge Distillation via Adaptive Sample Generation for Action Recognition

    Aug 4, 2026Ping Li, Chenhao Ping, Jie Song +1Knowledge DistillationMotion

  33. Auditing Data Provenance in LLM Fine-tuning via Intrinsic Distributional Fingerprints

    Aug 3, 2026Zirui Huang, Yunlong Mao, Wei Tong +3Large Language Model Fine-TuningProvenance

  34. Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning

    Aug 2, 2026Yuqi Li, Yuedong Tan, Huiran Duan +7Cross-Modal DistillationMulti-Object Tracking

  35. Progressive2^2: A Teacher-Student Progressive Co-Evolving Knowledge Distillation Method for Substantial Model Compression

    Jul 31, 2026Tiancong Cheng, Ying Zhang, Zhiwen Yu +2Teacher-Student DistillationKnowledge Distillation

  36. CoCaRS: Correlation Calibration-Based Redundancy Suppression for Heterogeneous Knowledge Distillation

    Jul 29, 2026Fengming Yu, Haiwei Pan, Kejia Zhang +3Knowledge DistillationTeacher

  37. From Proprietary to Open-Source: Bridging the Distribution Gap via Multi-Agent Protocol Distillation in Agentic Search

    Jul 27, 2026Junlin Liu, Jiangwang Chen, Zixin Song +7Knowledge DistillationAgentic Search

  38. SPRKD: Effective Knowledge Distillation for Deep Neural Networks via Saddle Region Approximation

    Jul 25, 2026Aditya Dewan, Arjun Yogeswaran, Benjamin FedorukKnowledge DistillationHessian

  39. When Does Knowledge Distillation Hurt? Reliability-Aware Distillation for Low-Resource Language Summarization

    Jul 22, 2026Dipto Sumit, Ankan Kumar Roy Srizon, Sadia Khair Rodela +4Knowledge DistillationSummarization

  40. RF-Agent: A Practical Framework for Building Language Agents for RFIC Design

    Jul 21, 2026Yueqi Xing, Houbo He, Jolie Wang +5Table Reasoning DatasetsElectronic Design Automation

  41. Rationale-Guided Knowledge Distillation for Cross-Lingual Stance Detection

    Jul 21, 2026Qiuli Zhou, Jingyuan Yao, Shengeng Tang +3Cross-Topic Arabic Stance DetectionMotion-Language Alignment

  42. Efficient Audio-Visual Event Recognition via Knowledge Distillation and Dynamic INT8 Quantization of a Hybrid Cross-Attention Network

    Jul 18, 2026Parinaz Binandeh Dehaghani, Danilo Pena, A. Pedro AguiarDetection TransformerKnowledge Distillation

  43. Symbiosis-Inspired Knowledge Distillation for Incremental Object Detection

    Jul 15, 2026Mingyue Zeng, De Cheng, Zhipeng Xu +3Class-Incremental LearningIntra-Class

  44. MobileSAM2: Lightweight Segment Anything for Spatial Intelligence

    Jul 14, 2026Kai Jiang, Jiaxing Huang, Jingyi Zhang +5Knowledge DistillationMobilenetv2

  45. Single-Teacher View Augmentation: Enhancing Knowledge Distillation with Student-Guided Perturbations

    Jul 13, 2026Xuyi Yu, Yaohua Liu, Ziming Song +3Knowledge DistillationMulti-Stage Training

  46. LaGuadia: Language-Guided Adaptive Distillation from Pathology Foundation Models

    Jul 13, 2026Gangsu Kim, Won-Ki JeongPathology Foundation ModelsMedical Vision-Language Models

  47. Knowledge Distillation for Automated AI Tutor Evaluation

    Jul 12, 2026Tahmid Al Hannan, Diego Garcia, Alex Njoroge +2TutorsPedagogical Frameworks

  48. BucketKD: A Safety-Aware Bucket-Based Knowledge Distillation Framework for End-to-End Motion Planning

    Jul 12, 2026Md Nahidul Islam, Mohd Hasan Ali, Dipankar Dasgupta +1Causality-Aware End-To-End Autonomous DrivingAutonomous Driving

  49. Transforming LLMs into Efficient Cross-Encoders via Knowledge Distillation for RAG Reranking

    Jul 11, 2026Shreeya Dasa Lakshminath, Shubhan SCross-EncoderAgentic Retrieval-Augmented Generation Systems

  50. CVKD-UDA: Cross-View Knowledge Distillation for 3D Unsupervised Domain Adaptive Segmentation

    Jul 11, 2026Zhimin Yuan, Ming Cheng, Shangshu Yu +4Interactive 3D SegmentationDomain Adaptation

  51. ZipDepth: Bringing Lightweight Zero-Shot Monocular Depth Anywhere, on Any Device

    Jul 9, 2026Fabio Tosi, Luca Bartolomei, Matteo Poggi +1Monocular Depth EstimationMobilenetv2

  52. SQuaD-SQL: Efficient Text-to-SQL with Small Language Models via LLM-Guided Knowledge Distillation

    Jul 9, 2026Wangyu Wu, Xiaojian Lin, Rong Fu +4Text-To-SqlSmall Large Language Models

  53. Enhancing deep learning models for time series classification via knowledge distillation

    Jul 7, 2026Javidan Abdullayev, Maxime Devanne, Jonathan Weber +1Knowledge DistillationTime-Series Classification

  54. Few-Medoids: An Embarrassingly Simple Coreset Selection Method for Few-Shot Knowledge Distillation

    Jul 7, 2026Cemil-Andrei Dilmac, Florinel-Alin Croitoru, Radu Tudor IonescuGeometry-Aware Uncertainty CoresetsKnowledge Distillation