Model Compression

Momentum

9 papers in the last four weeks, up 80% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 79

All topics
CardsList
  1. LACE-SVD: Loss-Aware SVD with Cumulative Error Correction for LLM Compression

    Jul 3, 2026Zhuowen Liu, Longkun Hao, Shiyu Feng +3Model CompressionLLM Compression

  2. SAB-LVLM: Significance-Aware Binarization for Large Vision-Language Models

    Jul 2, 2026Qi Lyu, Jiahua Dong, Baichen Liu +7Model CompressionVision-Language Models

  3. Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

    Jul 1, 2026Jaeah Lee, Hyunjin Kim, Jaewoong Cho +1Model CompressionDiffusion Transformer

  4. Drop-Then-Recovery: How Redundant Are Vision-Language-Action Models?

    Jun 26, 2026Guoheng Sun, Kaixi Feng, Shwai He +8Model CompressionEfficient VLA Models

  5. What Survives When You Compress a Recursive Reasoner for the Edge?

    Jun 25, 2026Pearse Jim, Steven Kolawole, Opegbemi Matthias Busoye +2Model CompressionEfficient Neural Network Inference

  6. Agentic evolution of physically constrained foundation models

    Jun 24, 2026Jiangwei Zhang, Wen Sun, Chong Wang +7Model CompressionLLM Quantization

  7. Hybrid Compression: Integrating Pruning and Quantization for Optimized Neural Networks

    Jun 22, 2026Minh-Loi Nguyen, Long-Bao Nguyen, Van-Hieu Huynh +2Model CompressionEfficient Neural Network Inference

  8. Scaling Audio Models Efficiently: Joint Optimization of Scale, Resolution, Adaptation, Precision, and Sparsity

    Jun 22, 2026Vyom Agarwal, Mokshda Gangrade, Siddharth Pal +1Model CompressionStructured Sparsity

  9. When Compression Helps and When It Hurts: Condition-Aware Analysis of Chain-of-Thought Distillation

    Jun 19, 2026Siyang Lyu, Xinghao Chen, Zhijing Sun +3Model CompressionCoT Distillation

  10. Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think

    Jun 18, 2026Gia-Binh Nguyen, Trong-Bao Ho, Thien-Loc Ha +18Model CompressionEfficient VLA Model Inference

  11. Complementary Attention Head Pruning for Efficient Transformers

    Jun 17, 2026Yaniv Livertovsky, Shahar Somin, Gonen SingerModel CompressionTransformer Attention

  12. Efficiency-Performance Trade-offs in Neural Speaker Diarization via Structured Pruning and Low-Bit Quantization

    Jun 12, 2026Rishit Chatterjee, Tahiya ChowdhuryModel CompressionSpeaker Diarization

  13. SigmaScale: LLM Compression with SVD-based Low-Rank Decomposition and Learned Scaling Matrices

    Jun 5, 2026Ernests Lavrinovics, Marco Letizia, Roy Janco +3Model CompressionLLM Compression

  14. LLMCodec: Adapting Video Codecs for Efficient Weight Compression of Large Language Models

    Jun 4, 2026Rui Wang, Yan Zhao, Li Song +1Model CompressionLLM Quantization

  15. Spatially Distributed Task-Oriented Compression for Multi-Emitter Localization and Characterization with Spectral Overlap

    May 31, 2026H. Nazim Bicer, J. Nicholas LanemanModel CompressionWireless Communications

  16. DASH: Dual-Branch Score Distillation for Guidance-Calibrated Compact Diffusion Models

    May 30, 2026Abdullah Al Shafi, Kazi Saeed Alam, Sk Imran Hossain +1Model CompressionClassifier-Free Guidance

  17. Smaller and Faster 3DGS via Post-Training Dictionary Learning

    May 28, 2026Jiarong Gong, Jonas Unger, Ehsan Miandji3DGS CompressionModel Compression

  18. LIFT and PLACE: A Simple, Stable, and Effective Knowledge Distillation Framework for Lightweight Diffusion Models

    May 19, 2026Hyunsoo Han, Sangyeop Yeo, Jaejun YooModel CompressionDiffusion Model Distillation

  19. SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models

    May 18, 2026Chengjie Hong, Feixiang He, Yiheng Zeng +2Model CompressionLow-Rank Compression

  20. MedCore: Boundary-Preserving Medical Core Pruning for MedSAM

    May 13, 2026Cenwei Zhang, Suncheng Xiang, Lei YouModel CompressionImage Segmentation

  21. Robust Basis Spline Decoupling for the Compression of Transformer Models

    May 11, 2026Joppe De Jonghe, Van Tien Pham, Mariya IshtevaModel CompressionTensor Decomposition

  22. XTinyU-Net: Training-Free U-Net Scaling via Initialization-Time Sensitivity

    May 10, 2026Alvin Kimbowa, Moein Heidari, David Liu +1Model CompressionU-Net

  23. PACE: Prune-And-Compress Ensemble Models

    May 7, 2026Fabian Akkerman, Julien Ferry, Théo Guyard +1Model CompressionEnsemble Learning

  24. Compress Then Adapt? No, Do It Together via Task-aware Union of Subspaces

    May 4, 2026Jingze Ge, Yun Liu, Xue Geng +4Model CompressionAdapter Tuning