Teacher-Student Learning

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 162

All topics
CardsList
  1. Decoupled Optimization for Teacher-Student Semi-Supervised Learning via a Pioneer Student

    Oct 7, 2026Haorong Han, Jidong Yuan, Chixuan Wei +1Semi-Supervised LearningTeacher-Student Learning

  2. Removing spurious minima for planar features by skip connections

    Oct 1, 2026Jakob Paul Zimmermann, Moritz Grillo, Andrei Balakin +1Shallow Neural NetworksReLU Neural Networks

  3. MC-PanDA++: Simpler, Stronger, and More Robust Domain-Adaptive Panoptic Segmentation

    Sep 30, 2026Ivan Martinović, Josip Šarić, Yuki M. Asano +1Panoptic SegmentationUnsupervised Domain Adaptation

  4. Examining Variation in How Guided AI Tutors Resolve Student Impasses

    Sep 29, 2026Bakhtawar Ahtisham, Kirk Vanacore, Alessandra Napoli +5Intelligent Tutoring SystemsEducational Data Mining

  5. TeacherGRPO: Closing the Capacity Gap in Reasoning Distillation via Teacher Alignment

    Sep 27, 2026Zhenyu Lei, Zihan Chen, Yaochen Zhu +5Reasoning DistillationRL for Language Model Reasoning

  6. FedMust: Semi-supervised Multi-task Student-Teacher Federated Learning for Multi-organ CT Segmentation

    Sep 21, 2026Ashkan Moradi, Bendik Skarre Abrahamsen, Mattijs ElschotMulti-Task LearningSemi-Supervised Medical Image Segmentation

  7. A Novel Robot-Assisted Learning Pedagogy for Children with ASD

    Sep 13, 2026Laura Boccanfuso, Erin Barney, Marilena Mademtzi +7Assistive RoboticsHuman-Robot Interaction

  8. Teacher Geometry Shapes Learnability in Teacher-Student Networks

    Sep 10, 2026Kai J. Sandbrink, Flavio Martinelli, Alexander van Meegen +2Neural Network OptimizationNeural Network Training Dynamics

  9. Rethinking the Teacher-Student Framework for Test-Time Adaptation

    Sep 2, 2026Damian Sójka, Marc Masana, Bartłomiej Twardowski +1Test-Time AdaptationTeacher-Student Learning

  10. TeaMatch: Teachable Cross-Modal Representation Learning for 2D-3D Matching

    Aug 10, 2026Chongjian Wang, Junjie GaoCross-Modal Representation LearningImage Matching

  11. Source-Free Controlled Adaptation of Teachers for Continual Test-Time Adaptation

    Jul 26, 2026Anurag Roy, Riddhiman Moulick, Vinay Kumar Verma +2Source-Free Domain AdaptationDomain Adaptation

  12. On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity

    Jun 24, 2026Andrei Liviu Nicolicioiu, Mohammad Pezeshki, Aaron CourvilleOn-Policy Self-DistillationLanguage Model Distillation

  13. Spatio-Temporal Retrieval-based Priors for Adaptive Computational Teaching in Driving

    Jun 23, 2026Deepak Edakkattil Gopinath, Xiongyi Cui, Jonathan DeCastro +2Autonomous DrivingImitation Learning

  14. AsyncOPD: How Stale Can On-Policy Distillation Be?

    Jun 23, 2026Wonjun Kang, Kevin Galim, Seunghyuk Oh +9Language Model DistillationOn-Policy Distillation

  15. ARIA: Adaptive Region-Based Importance Allocation for Conditional Diffusion Distillation

    Jun 22, 2026Loay Mualem, Vinh Tong, Samir Darouich +1Diffusion Model DistillationTeacher-Student Learning

  16. The Professor: Multi-Teacher Unsupervised Prompt Distillation for Vision-Language Models

    Jun 22, 2026Ahmad Algadhi, Ahmed Alzuhair, Omar Alkhulaif +1VLM DistillationMulti-Teacher Knowledge Distillation

  17. Finding the Evidence: Discovering Decision-Supporting Tokens for On-Policy Reasoning Distillation

    Jun 22, 2026Jinwei Xiao, Zhuowen Han, Yueqing Sun +6CoT DistillationOn-Policy Distillation

  18. LoCC: Detection and Localization of Lip-Syncing Deepfakes via Counterfactual Frame Consistency

    Jun 22, 2026Soumyya Kanti Datta, Shan Jia, Siwei LyuDeepfake DetectionTeacher-Student Learning

  19. On the Position Bias of On-Policy Distillation

    Jun 21, 2026Yan Xie, Sijie Zhu, Tiansheng Wen +2Importance WeightingLanguage Model Distillation

  20. Channel Location Constrains the Auditability of Subliminal Learning

    Jun 20, 2026Tamas MadlSubliminal LearningLanguage Model Distillation

  21. Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts

    Jun 20, 2026Qingfei Zhao, Huan Song, Shuyu Tian +2Trajectory GenerationCoT Distillation

  22. When Compression Helps and When It Hurts: Condition-Aware Analysis of Chain-of-Thought Distillation

    Jun 19, 2026Siyang Lyu, Xinghao Chen, Zhijing Sun +3Model CompressionCoT Distillation

  23. Reference-Based Distillation Detection in LLMs

    Jun 19, 2026Rajat Rawat, Sizhe Chen, Akshay Anand +3LLM AuditingTeacher-Student Learning

  24. PowerOPD: Stabilizing On-Policy Distillation with Bounded Power Transformation

    Jun 15, 2026Anhao Zhao, Junlong Tong, Yingqi Fan +3On-Policy DistillationTeacher-Student Learning

  25. Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

    Jun 15, 2026Zhongzhu Zhou, Qingyang Wu, Junxiong Wang +4Neural Network InitializationLinear Attention

  26. LectūraAgents: A Multi-Agent Framework for Adaptive Personalized AI-Assisted Learning and Embodied Teaching

    Jun 15, 2026Jaward Sesay, Yue Yu, Siwei Dong +1Multi-Agent LLM SystemsIntelligent Tutoring Systems

  27. On-Policy Distillation with Curriculum Turn-level Guidance for Multi-turn Agents

    Jun 14, 2026Gengsheng Li, Mao Zheng, Mingyang Song +8Language Model DistillationLLM Agent Training

  28. Localizing Credit at the Divergence: Path-Conditioned Self-Distillation for LLM Reasoning

    Jun 14, 2026Yu Li, Shu Hong, Tian LanRL for Language Model ReasoningCredit Assignment in RL

  29. Teacher-Student Structure for Domain Adaptation in Ensemble Audio-Visual Video Deepfake Detection

    Jun 13, 2026Elham Abolhasani, Maryam Ramezani, Hamid R. RabieeAudio Deepfake DetectionDomain Adaptation

  30. Robust Fall Recovery for Armless Bipedal-Wheeled Robots Via Force-Guided Learning

    Jun 12, 2026Haidong Hou, Zhangguo Yu, Tao Han +6Robot Failure RecoveryRobot Locomotion

  31. Dense Supervision, Sparse Updates: On the Sparsity and Geometry of On-Policy Distillation

    Jun 11, 2026Guo Yu, Wenlin Liu, Yulan Hu +3Sparse Fine-TuningOn-Policy Distillation

  32. A solvable model for unsupervised federated learning

    Jun 11, 2026Giovanni Catania, Aurélien Decelle, Gianluca Manzan +2Statistical Physics of LearningUnsupervised Learning

  33. Beyond Dark Knowledge: Mixup-Based Distillation for Reliable Predictions

    Jun 10, 2026José Medina, Paul Honeine, Abdelaziz Bensrhair +1Data AugmentationModel Calibration

  34. Hey Chat, Can You Teach Me? Structuring Socratic Dialogue for Human Learning in the Wild

    Jun 10, 2026Sidney Tio, Arunesh Sinha, Pradeep VarakanthamIntelligent Tutoring SystemsAI in Education

  35. RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation

    Jun 10, 2026Leyi Pan, Shuchang Tao, Yunpeng Zhai +5RL for Language Model ReasoningLanguage Model Distillation

  36. Quantifying Subliminal Behavioral Transfer Ratios in Language Model Distillation

    Jun 9, 2026Uwe König, Hamza Kazmi, Ruizhe Li +1Subliminal LearningLanguage Model Distillation

  37. PADD: Path-Aligned Decompression Distillation for Non-Router Teacher to Guide MoE Student Learning

    Jun 9, 2026Xinyue Peng, Yi Qian, Jiaojiao Lin +2Mixture-of-Experts Language ModelsExpert Routing

  38. Escaping the KL Agreement Trap in On-Policy Distillation

    Jun 8, 2026Haoran Xin, Anhao Zhao, Ying Sun +3On-Policy DistillationTeacher-Student Learning

  39. SG-OPD: Sign-Gated On-Policy Distillation via Sign-Consistency Gating and Phased Teacher Sampling

    Jun 8, 2026Haoran Xu, Hongyu Wang, Yifei Gao +3Language Model DistillationOn-Policy Distillation

  40. Trajectory-Refined Distillation

    Jun 7, 2026Li Jiang, Haoran Xu, Yichuan Ding +1On-Policy DistillationLLM Post-Training

  41. OPRD: On-Policy Representation Distillation

    Jun 4, 2026Shenzhi Yang, Guangcheng Zhu, Bowen Song +8Cross-Architecture Knowledge DistillationLanguage Model Distillation

  42. Compress-Distill: Reasoning Trace Compression for Efficient Knowledge Distillation

    Jun 4, 2026Maxime Griot, Paul Steven Scotti, Tanishq Mathew AbrahamCoT DistillationTeacher-Student Learning

  43. ViCuR: Visual Cues as Recoverable Privilege for Multimodal On-Policy Distillation

    Jun 4, 2026Kanghui Tian, Siyuan Liu, Ziang Yan +3VLM DistillationMultimodal Reasoning

  44. SocraticPO: Policy Optimization via Interactive Guidance

    Jun 3, 2026Zirui Liu, Jie Ouyang, Qi Liu +8RL for Language Model ReasoningLLM-Guided RL

  45. When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillation

    Jun 2, 2026Haowei Guo, Baolong Bi, Ruicheng Zhang +2On-Policy Self-DistillationLanguage Model Distillation

  46. What Makes Interaction Trajectories Effective for Training Terminal Agents?

    Jun 2, 2026Sidi Yang, Chaofan Tao, Jierun Chen +11AI Agent BenchmarksLLM Agent Training

  47. What Do Students Learn? A Feature-Level Analysis of Dark Knowledge

    Jun 2, 2026Seungu Kang, Songkuk KimRepresentation LearningSelf-Distillation

  48. Why Are DMD Students Lazy? Understanding the Copying Behavior in Few-Step Distillation

    Jun 1, 2026Shucheng Li, Iolo Jones, Alexander Tong +1Diffusion Model DistillationFew-Step Diffusion Sampling

  49. What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear Regression

    May 31, 2026Wendao Wu, Fangqing Zhang, Haihan Zhang +1Weak-to-Strong GeneralizationTeacher-Student Learning

  50. OPD+: Rethinking the Advantage Design for On-Policy Distillation

    May 31, 2026Hanyang Zhao, Haoxian Chen, Han Lin +3Language Model DistillationPolicy Gradient Methods

  51. Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher

    May 31, 2026Arda Uzunoglu, Alvin Zhang, Daniel KhashabiData SelectionTraining Data Selection

  52. Subliminal Learning Is Steering Vector Distillation

    May 31, 2026Camila Blank, Agam Bhatia, Senthooran Rajamanoharan +2Language Model SteeringSubliminal Learning

  53. DASH: Dual-Branch Score Distillation for Guidance-Calibrated Compact Diffusion Models

    May 30, 2026Abdullah Al Shafi, Kazi Saeed Alam, Sk Imran Hossain +1Model CompressionClassifier-Free Guidance

  54. Logit Distillation on Manifolds: Mapping by Learning

    May 30, 2026Yiru Yang, Junling Wang, Nishant Kumar Singh +2Teacher-Student LearningRepresentation Alignment