Dataset Distillation

Latest papers 241

All topics
CardsList
  1. DMAD: Distribution Matching as Adversarial Distillation for Fast Visual Generation

    Oct 1, 2026Zhengming Yu, Junkun Yuan, Haotian Yang +8Distribution Matching DistillationDataset Distillation

  2. Omni-Embed-Mini: Binding Modalities Without Forgetting via Dense Distillation

    Oct 1, 2026Mohammed Irfan Kurpath, Jaseel Muhammad Kaithakkodan, Sahal Shaji Mullappilly +2Multimodal EmbeddingsOmni-Modal

  3. DecomVoxel: Harnessing 3D-Native Priors with Guided In-situ Denoising Optimization for Decompositional Scene Reconstruction

    Oct 1, 2026Junfeng Ni, Zirui Zhou, Yixin Chen +5Scene ReconstructionVoxel

  4. Distribution Matching Distillation for Continuous Diffusion Language Models

    Sep 30, 2026Paul Le Van Kiem, Dario Shariatian, Umut Simsekli +1Diffusion Language ModelsDiffusion Models

  5. Enhancing Autoregressive Video Generation via Representation Adversarial Distillation

    Sep 30, 2026Fangyu Lin, Xingtong Ge, Lunjie Zhu +8Autoregressive Video GenerationVideo Generation

  6. Learning to Reason with Compressed Context: Ground-Truth-Free Adaptation of OmniLLMs via Self-Distillation

    Sep 30, 2026Jianghao Wang, Ke Meng, Jian Li +7Large Language Model AdaptationDataset Distillation

  7. Revisiting On-policy Adversarial Black-Box Distillation: Calibrating Groupwise Reward Geometry for Effective Advantage Construction

    Sep 30, 2026Xiao Cui, Mo Zhu, Yulei Qin +3Dataset DistillationOn-Policy

  8. Diffusable Latents from Structure-Agnostic Distillation

    Sep 30, 2026Adrien Ramanana Rahary, Nicolas Dufour, Patrick Pérez +1Dataset DistillationVideo Latents

  9. Uncertainty-Aware Consistency Distillation for Few-Step Video Generation

    Sep 30, 2026Lingyu Liu, Yaxiong Wang, Li Zhu +1Dataset DistillationAdversarial Training

  10. VAA-CSEC: Vote-guided Advantage Allocation for Chinese Semantic Error Correction

    Sep 29, 2026Yitong Han, Nankai Lin, Juan Luo +3Grammatical Error CorrectionCorrection

  11. What Makes High-Magnification Knowledge Transferable? A Study of Cross-Resolution Distillation in Whole-Slide Imaging

    Sep 29, 2026Zhiyuan Yang, Jiahao Cheng, Mahdi S. HosseiniWhole-Slide ImagesCross-Task Knowledge Transfer

  12. The Composition Gap in Dataset Distillation

    Sep 28, 2026Guang Li, Takahiro Ogawa, Miki HaseyamaDiffusion-Based Dataset DistillationProbe-Logit Distillation

  13. PSM: Dataset Distillation Based on Precise Statistical Matching by Difficulty

    Sep 28, 2026Hongxu Ma, Guang Li, Shijie Wang +6Diffusion-Based Dataset DistillationDataset Distillation

  14. Waggle: Learning One Anonymous Local Law for Self-Organizing LLM Swarms

    Sep 28, 2026Mingxi Zou, Wei Zhu, Zhuo Wang +4Multi-Agent CoordinationGlobal Coordination

  15. TTRSD: Test-Time Reinforcement Learning with Self-Distillation for Vision-Language Models

    Sep 27, 2026Shuning Wang, Zhiheng Wu, Xun Zhou +8Multimodal Reasoning BenchmarksDataset Distillation

  16. Geometry-Conditioned Visual Place Recognition in Natural Environments

    Sep 23, 2026Walter Nedov, Saimunur Rahman, Kavindie Katuwandeniya +3Visual Place RecognitionDataset Distillation

  17. MIND the Gap: A Geographic Implicit Neural Representation with Adjustable Spatial Scale

    Sep 21, 2026Isaac Corley, Arjun Rao, Esther Rolf +7Neural RepresentationsText Embeddings

  18. Efficient LLM Distillation for Bangladesh Legal Context: A Smartphone-Compatible Retrieval-Augmented Generation Model

    Sep 21, 2026MD. Nafis Kamal, Mahadi Hasan Fahim, Talha Ridwan +4BanglaDataset Distillation

  19. HapticWAM: Distilling Imagined Touch into a World-Action Model without Inference-Time Tactile Sensing

    Sep 20, 2026Mikhail Sannikov, Ilya Mikhalchuk, Konstantin Gubernatorov +3Tactile World ModelTactile

  20. StageGuard: Learning Stage Transitions for Long-Horizon Robot Tasks via Agentic Distillation

    Sep 17, 2026Jinbang Huang, Yuanzhao Hu, Zhiyuan Li +6Robot StateRobot Policies

  21. ZipCodec: Ultra-Low-Frame-Rate Streaming Speech Coding

    Sep 12, 2026Luca Della Libera, Cem Subakan, Mirco RavanelliNeural Speech CodecsDataset Distillation

  22. ALRA: Adaptive Local Relational Alignment for Logit-Based Pre-training Distillation of Autoregressive Language Models

    Sep 3, 2026Quang Hoang Trung, Quang Huu Hieu, Nguyen Van Hoang Phuc +1Dataset DistillationKnowledge Distillation

  23. SelfLift: Accelerating Few-Step Diffusion via Self-Recovering Resolution Transition

    Sep 2, 2026Tingyan Wen, Chenqian Yan, Xurui Peng +4Dataset DistillationSelf

  24. Cross-Model Distillation of a Human-Pose Foundation Model from Unannotated Infant Video for Markerless 3D Pose Estimation

    Sep 1, 2026R. James Cotton, Divya Joshi, Colleen PeytonWifi-Csi 3D Human Pose Estimation3D Foundation Models

  25. Subliminal Learning as Trait-Direction Drift: A Mechanism and Targeted Control under SFT Distillation

    Sep 1, 2026Zhixuan Liu, Zhichen Dong, Yuyu Fan +2Dataset Distillation

  26. CRAD: Class-wise Reliability-Aware Distillation for Decentralized Heterogeneous Federated Learning

    Aug 31, 2026Baraa Bilbeisi, Mengchen Fan, Baocheng Geng +1Federated LearningDataset Distillation

  27. Identity-Conditioned Latent Consistency Distillation for Face Synthesis

    Aug 31, 2026Tiago Kienen Chaves, Bernardo Biesseck, David MenottiIdentity-Conditioned Latent Diffusion ModelsDataset Distillation

  28. Modality Disentangled Learning for Incomplete Multimodal Emotion Recognition: A Primitive Memory Distillation Perspective

    Aug 31, 2026Jiaqi Zhang, Zheng Pang, Mengting Li +9Multimodal LearningEmotion Recognition

  29. Stratified Consistency Distillation for Natural Language Formalization

    Aug 31, 2026Zhichao Hou, Ferhat Erata, Joe Lilien +1LLM Reasoning StrategiesNeuro-Symbolic Framework

  30. MI-Distillation: Selecting from Model-Interpolated Instruct-Reasoning Data Spectrum for Chain-of-Thought Distillation

    Aug 30, 2026Yangsong Lan, Renkai Hu, HongKai Zheng +4Dataset DistillationLarge Reasoning Models

  31. P2Fusion: Prompt-based Progressive Infrared-Visible Image Fusion via Dual-Prior Distillation

    Aug 13, 2026Yi Shi, Huichao Xie, Yuqing Wang +7Infrared-Visible Image FusionAdm-Fusion

  32. PixSDS: Why Latent SDS Makes Noisy Pixels

    Aug 13, 2026Vsevolod Skorokhodov3D Generative ModelsPixelloop

  33. Training Under Challenge: Executable Certificates and Challenge-Closed Optimality for Neural Networks

    Aug 12, 2026Farhang Yeganegi, Arian Eamaz, Mojtaba SoltanalianNeural Network VerificationFinite-Sample Certificates

  34. LoongReflect: Boosting Long-Horizon Reflection in Search Agents via Global Perspective Distillation

    Aug 12, 2026Zhixin Zhang, Xinke Jiang, Zhibang Yang +5Long-Horizon AgentsAgentic Reinforcement Learning

  35. Temporally Grounded Compositional Camera Motion Understanding via Geometric Knowledge Distillation

    Aug 11, 2026Dazhao Du, Shiyan Du, Jian Liu +8Camera ControlMotion

  36. Grid-Preserving Knowledge Distillation: Transferring Convolutional Inductive Bias to Vision Transformers under Data Scarcity

    Aug 11, 2026Junyong Choi, Cheolhyeon Park, Jaehoon ChoVision TransformerKnowledge Distillation

  37. Perception Before Supervision: Self-Contained Visual Distillation from Counterfactual Blind Spots

    Aug 10, 2026Shravan Venkatraman, Omkar Thawakar, Ritesh Thawkar +2Recent Vision-Language ModelsDataset Distillation

  38. Distill Skills into Weights, Not Prompts: Abstract Skills as Privileged Signals for On-Policy Self-Distillation

    Aug 10, 2026Yubo Jiang, Fengying Xie, Zhiguo Jiang +1Unsupervised On-Policy Self-DistillationDataset Distillation

  39. Subliminal Learning is Non-Semantic Distillation

    Aug 6, 2026Ethan Hadley, Eren GultepeDataset DistillationSynthetic Data

  40. Spectral Distillation: From Nonlinear Dynamics to Linear State-Space Models

    Aug 5, 2026Liane Galanti, Devan Shah, Shlomo Fortgang +1System IdentificationNonlinear Dynamics

  41. Efficient Video Dataset Distillation via Cluster-Guided Prototype Blending

    Aug 4, 2026Chongle Ren, Guang Li, Wenbo Huang +3Diffusion-Based Dataset DistillationDataset Distillation

  42. Self-Supervised Representation-Guided Generative Dataset Distillation

    Aug 4, 2026Mingzhuo Li, Guang Li, Linfeng Ye +4Diffusion-Based Dataset DistillationDataset Distillation

  43. Learning What to Remember: Test-Time Training via Context Distillation

    Aug 3, 2026Zixuan Wang, Xingyu Dang, Rui-Jie Zhu +4Efficient Long-Context InferenceTest-Time Training

  44. Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning

    Aug 2, 2026Yuqi Li, Yuedong Tan, Huiran Duan +7Cross-Modal DistillationMulti-Object Tracking

  45. Harnessing Adversarial Distillation to Customise Debiased, Disease-Specific Pathology Foundation Models for Breast Cancer

    Aug 2, 2026Zhiwei Chen, Yang Hu, Yuxiang Xiao +7Pathology Foundation ModelsDigital Pathology

  46. TurboClear: One-Step Object-Effect Removal via Region-Calibrated Distribution Matching and Fusion

    Aug 2, 2026Jiawei Guo, Junxian Li, Yixin Tang +4Video Object RemovalDataset Distillation

  47. WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA

    Aug 2, 2026Zhihao Zhu, Hanlin Shang, Mingwang Xu +6Autonomous DrivingDiffusion-Based Vision-Language-Actions

  48. LUT: Latent Utility Training for Visual Reasoning

    Aug 1, 2026Jiaxuan Kang, Siyu Chen, Mingda Li +6Latent Visual ReasoningVisual Reasoning

  49. RHEA: Reliability-Harmonized Reconstruction and Assignment for Robust Multimodal-Attributed Graph Clustering

    Aug 1, 2026Yinlin Zhu, Di Wu, Ziyu Han +4Text-Attributed GraphDataset Distillation