Teacher

Momentum

51 papers in the last four weeks, up 219% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 203

All topics
CardsList
  1. Reference-Based Distillation Detection in LLMs

    Jun 19, 2026Rajat Rawat, Sizhe Chen, Akshay Anand +3Teacher-Student DistillationTeacher

  2. Dyna-DINO: Efficient ViT Distillation Via Adaptive Representation Anchoring

    Jun 17, 2026Jiaqi Zhang, Ashton Lee, Anthony Wong +3Knowledge DistillationDataset Distillation

  3. Trust the Right Teacher: Quality-Aware Self-Distillation for GUI Grounding

    Jun 16, 2026Jingyuan Huang, Zuming Huang, Yucheng Shi +4Graphical User InterfaceSelf-Distillation Framework

  4. When English Isn't the Best Teacher: Source Language Effects in Cross-Lingual In-Context Learning

    Jun 16, 2026Fred Philippy, Siwen Guo, Jacques Klein +1Cross-Lingual TransferLanguage Pairs

  5. Confusion-Aware Transfer Teacher Curriculum Learning Framework: Disentangling Scoring and Pacing Effects

    Jun 16, 2026Savini Kommalage, Sanka Mohottala, Asiri Gawesha +5Adaptive CurriculumCurriculum

  6. On-Policy Distillation with Curriculum Turn-level Guidance for Multi-turn Agents

    Jun 14, 2026Gengsheng Li, Mao Zheng, Mingyang Song +8TeacherCurriculum

  7. Teacher-Student Structure for Domain Adaptation in Ensemble Audio-Visual Video Deepfake Detection

    Jun 13, 2026Elham Abolhasani, Maryam Ramezani, Hamid R. RabieeEnvironmental Sound Deepfake DetectionDeepfake Detection

  8. Beyond the Golden Teacher: Enhancing Graph Learning through LLM-GNN Co-teaching

    Jun 10, 2026Zhuoyi Peng, Hanlin Gu, Lixin Fan +1Gnn-Based DetectorsHigh Confidence Pseudo-Labels

  9. PADD: Path-Aligned Decompression Distillation for Non-Router Teacher to Guide MoE Student Learning

    Jun 9, 2026Xinyue Peng, Yi Qian, Jiaojiao Lin +2Teacher-Student DistillationTeacher

  10. AI tools in Arab University English classrooms: Looking back and forward

    Jun 8, 2026Mohammed Q. Shormani, Muneef Yehia AlshawshClassroomsArabic

  11. SG-OPD: Sign-Gated On-Policy Distillation via Sign-Consistency Gating and Phased Teacher Sampling

    Jun 8, 2026Haoran Xu, Hongyu Wang, Yifei Gao +3Efficient On-Policy DistillationTeacher

  12. CRANE: Knowledge Editing for Reasoning MLLMs

    Jun 8, 2026Han Huang, Hao Wang, Mengqi Zhang +3LLM Reasoning StrategiesChain-of-Thought Reasoning

  13. Trajectory-Refined Distillation

    Jun 7, 2026Li Jiang, Haoran Xu, Yichuan Ding +1Symbolic DistillationTeacher

  14. Unsupervised Continual Clustering via Forward-Backward Knowledge Distillation

    Jun 5, 2026Mohammadreza Sadeghi, Sareh Soleimani, Zihan Wang +1Replay-Based Continual LearningClustering

  15. HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teachers

    Jun 4, 2026Lizhi Yang, Junheng Li, Nehar Poddar +5Whole-Body ControlFull-Body Humanoid Control

  16. OPRD: On-Policy Representation Distillation

    Jun 4, 2026Shenzhi Yang, Guangcheng Zhu, Bowen Song +8TeacherToken-Level Uncertainty

  17. SocraticPO: Policy Optimization via Interactive Guidance

    Jun 3, 2026Zirui Liu, Jie Ouyang, Qi Liu +8Frictive Policy OptimizationSocratic Dialogue

  18. When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillation

    Jun 2, 2026Haowei Guo, Baolong Bi, Ruicheng Zhang +2Efficient On-Policy DistillationTeacher

  19. VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization

    Jun 1, 2026Junhao Cheng, Liang Hou, Tianxiong Zhong +4Teacher

  20. When Rating Scales Fall Short: LLM-Assisted Discovery of ADHD Signals in Turkish Teacher Narratives

    Jun 1, 2026Baris Karacan, Irem Aktar Songur, Ahmet Ozaslan +1Autism Spectrum DisorderComputerized Adaptive Testing

  21. What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear Regression

    May 31, 2026Wendao Wu, Fangqing Zhang, Haihan Zhang +1Cross-Task Knowledge TransferKnowledge Distillation

  22. Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher

    May 31, 2026Arda Uzunoglu, Alvin Zhang, Daniel KhashabiLearnabilityTeacher

  23. Subliminal Learning Is Steering Vector Distillation

    May 31, 2026Camila Blank, Agam Bhatia, Senthooran Rajamanoharan +2Multiple Prompt Learning FrameworksSteering

  24. Logit Distillation on Manifolds: Mapping by Learning

    May 30, 2026Yiru Yang, Junling Wang, Nishant Kumar Singh +2Residual DistillationTeacher

  25. Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs

    May 30, 2026Yu-An Lu, Ci-Yang Tsai, Yu-Lin Tsai +2Reasoning TracesLLM Reasoning Strategies

  26. Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Distillation

    May 29, 2026Yanjiang Liu, Jie Lou, Xinyan Guan +7TeacherDataset Distillation

  27. Surfacing Isolated Learners with Outcome-Independent Mediation of Feedback between Teachers and Students Using AI

    May 28, 2026Junsoo Park, Youssef Medhat, Htet Phyo Wai +2TeacherFeedback

  28. Skill-Conditioned Gated Self-Distillation for LLM Reasoning

    May 27, 2026Jiazhen Huang, Xiao Chen, Xiao Luo +3Unsupervised On-Policy Self-DistillationLLM Reasoning Strategies

  29. Teacher-Student Representational Alignment for Reinforcement Learning-Driven Imitation Learning

    May 27, 2026Meraj Mammadov, Pedro Zuidberg Dos Martires, Johannes Andreas StorkTemporally Coherent Imitation LearningImitation Learning

  30. Reflective Dialogue between Teacher and Solver Agents for Video Question Answering

    May 27, 2026Takuya Murakawa, Toru TamakiLong Video Question AnsweringIn-Context Learning

  31. Adversarial Dual On-Policy Distillation from Expressive Teacher

    May 26, 2026Zhenglin Wan, Jingxuan Wu, Xingrui Yu +5Multimodal Action DistributionsBehavior Cloning

  32. When the Strongest Teacher Is Not the Best Teacher: Student-Centric Answer Selection

    May 26, 2026Zhengyu Hu, Zheyuan Xiao, Linxin Song +10TeacherEffective Distillation

  33. On-Policy Adversarial Flow Distillation for Autoregressive Video Generation

    May 25, 2026Yang Luo, Shengju Qian, Xiaohang Tang +4Autoregressive Video GenerationVideo Generation

  34. The Distillation Game: Adaptive Attacks & Efficient Defenses

    May 21, 2026Youssef Allouah, Mahdi Haghifam, Sanmi Koyejo +1Distribution Matching DistillationLLM Defense Mechanisms

  35. A Boundary-Layer Mechanism for One-Third Scaling in Online Softmax Classification

    May 21, 2026Marcel Kühn, Yoon Thelge, Bernd RosenowBatchGumbel-Softmax Relaxation

  36. TextTeacher: What Can Language Teach About Images?

    May 21, 2026Tobias Christian Nauen, Stanislav Frolov, Brian Bernhard Moser +3ImagenetText Embeddings

  37. Toward Understanding Adversarial Distillation: Why Robust Teachers Fail

    May 21, 2026Hongsin Lee, Hye Won ChungTeacher-Student DistillationDataset Distillation

  38. X-Token: Projection-Guided Cross-Tokenizer Knowledge Distillation

    May 20, 2026Sharath Turuvekere Sreenivas, Adithyakrishna Venkatesh Hanasoge, Mingyu Yang +4Teacher-Student DistillationSingle-Token Output Distributions

  39. When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning

    May 20, 2026Xiaogeng Liu, Xinyan Wang, Yingzi Ma +2TeacherOn-Policy

  40. AVSD: Adaptive-View Self-Distillation by Balancing Consensus and Teacher-Specific Privileged Signals

    May 20, 2026Duy Nguyen, Hanqi Xiao, Archiki Prasad +7Self-Distillation FrameworkTeacher

  41. Distilling Tabular Foundation Models for Structured Health Data

    May 18, 2026Aditya Tanna, Nassim Bouarour, Mohamed Bouadi +2Tabular Foundation ModelsMedical World Model

  42. Roll Out and Roll Back: Diffusion LLMs are Their Own Efficiency Teachers

    May 16, 2026Fanqin Zeng, Feng Hong, Geng Yu +6Diffusion Language ModelsGenerative Quality

  43. How to Choose Your Teacher for Fine Grained Image Recognition

    May 15, 2026Oswin Gosal, Edwin Arkel Rios, Augusto Christian Surya +3Knowledge DistillationTeacher

  44. Cognitive-Uncertainty Guided Knowledge Distillation for Accurate Classification of Student Misconceptions

    May 14, 2026Qirui Liu, Hao Chen, Weijie Shi +2Student MisconceptionsKnowledge Distillation

  45. Teacher-Guided Policy Optimization for On-Policy Reasoning Distillation under Large Policy Divergence

    May 13, 2026Xinyu Liu, Kechen Jiao, Chunyang Xiao +10Frictive Policy OptimizationTeacher

  46. On the Generalization of Knowledge Distillation: An Information-Theoretic View

    May 13, 2026Bingying Li, Haiyun HeKnowledge DistillationProbe-Logit Distillation

  47. Adaptive Teacher Exposure for Self-Distillation in LLM Reasoning

    May 12, 2026Zihao Han, Tiangang Zhang, Huaibin Wang +1Self-Distillation FrameworkTeacher

  48. LLaVA-CKD: Bottom-Up Cascaded Knowledge Distillation for Vision-Language Models

    May 11, 2026Nikolaos Gkalelis, Vasileios MezarisKnowledge DistillationTeacher

  49. Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation

    May 10, 2026Yuxuan Jiang, Runchao Li, Shubhashis Roy Dipta +2TeacherCard

  50. The Extrapolation Cliff in On-Policy Distillation of Near-Deterministic Structured Outputs

    May 9, 2026Xin Li, Hao Jiang, Annan Wang +2TeacherGradient Clipping

  51. SOD: Step-wise On-policy Distillation for Small Language Model Agents

    May 8, 2026Qiyong Zhong, Mao Zheng, Mingyang Song +5LLM Reasoning StrategiesAgentic Reasoning

  52. SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation

    May 8, 2026Jie Sun, Mao Zheng, Mingyang Song +6TeacherTokenizer