Compressed Model

Latest papers 41

All topics
CardsList
  1. A Tilted Bowl Is Not a Slippery Slope: Compressing Looped Models

    Sep 30, 2026Steven Kolawole, Pearse Jim, Opegbemi M. Busoye +2Compressed ModelModel Weights

  2. FairCompressAgent: An Agentic Framework for Fairness-Aware Model Compression for FPGA Deployment

    Sep 15, 2026Yuanbo Guo, Yiyu ShiCompressed ModelQuantization-Aware Training

  3. The Cost of Compression: A Rate-Distortion Limit on Factual Hallucination

    Sep 14, 2026Xi Wang, Shijia Xu, Rongfeng GuoFactual RecallVisual Hallucinations

  4. On the Interaction Between Model Compression and Test-Time Adaptation

    Sep 3, 2026Francesco Corti, Dong Wang, Young D. Kwon +2Stable Test-Time AdaptationCompressed Model

  5. Emergence of Fibrations, Compression, and Symmetry Breaking in Artificial Neural Networks

    Sep 1, 2026Osvaldo M Velarde, Lucas C Parra, Alireza Hashemi +1SymmetryCompressed Model

  6. Linear Reusable Neural Bases Architecture for Network Compression

    Sep 1, 2026Binshuai Wang, Peng Wei, Mahyar GhazanfariCompressed ModelRecurrent Neural Networks

  7. Breaking the Compression Barrier: Cross-Architecture Compression Boundary Learning via Reverse Regrowth

    Aug 17, 2026Zhaocen Liu, Satvik Praveen, Yi ShengCompressed ModelTask-Aware Compression

  8. UniMoMo: Expert Merging-Based MoE Acceleration for Large Recommendation Models

    Aug 9, 2026Lei Xin, Bin Gu, Peize Li +8ExpertsCompressed Model

  9. ZIPBrain: Can EEG Foundation Models Be Faster, Locally Deployable, but Accurate?

    Aug 7, 2026Lingwei Li, Yirong Kan, Peng Chen +3Electroencephalography Foundation ModelsElectroencephalography

  10. Topological Simplification in Predictive Coding Networks

    Aug 3, 2026Adam Shaw, Jiayu Li, Michael Sperling +2Predictive CodingCompressed Model

  11. SparseKAN: Compressing Kolmogorov--Arnold Networks Across Basis Functions, Neurons, and Bits

    Aug 1, 2026Kazi Ahmed Asif Fuad, Lizhong ChenKolmogorov-Arnold NetworksCompressed Model

  12. Progressive2^2: A Teacher-Student Progressive Co-Evolving Knowledge Distillation Method for Substantial Model Compression

    Jul 31, 2026Tiancong Cheng, Ying Zhang, Zhiwen Yu +2Teacher-Student DistillationKnowledge Distillation

  13. Memory Efficient Tabular Foundation Models

    Jul 30, 2026Shuting Luo, Monika Mikhail Kanaan, Cameron Gordon +2Tabular Foundation ModelsTabular Learning

  14. CineMobile: On-Device Image-to-Video Diffusion for Cinematic Camera Motion Generation

    Jul 4, 2026Xuyao Huang, Zelai Deng, Xu Wang +2Diffusion TransformersCamera Control

  15. What Survives When You Compress a Recursive Reasoner for the Edge?

    Jun 25, 2026Pearse Jim, Steven Kolawole, Opegbemi Matthias Busoye +2Compressed ModelRecursive Reasoner

  16. Hybrid Compression: Integrating Pruning and Quantization for Optimized Neural Networks

    Jun 22, 2026Minh-Loi Nguyen, Long-Bao Nguyen, Van-Hieu Huynh +2Compressed ModelNeural Network Inference

  17. Improved Knowledge Distillation for Land-Use Image Classification

    Jun 12, 2026Arundhuti Sur, Abhiroop Chatterjee, Susmita Ghosh +1Knowledge DistillationLand Cover

  18. Compressed Computation is (probably) not Computation in Superposition

    Jun 12, 2026Jai Bhagat, Sara Molas-Medina, Giorgi Giglemiani +1Compressed ModelMultilayer Perceptrons

  19. Sigma-Branch: Hierarchical Single-Path Network Reconstruction for Dynamic Inference with Reduced Active Parameters

    Jun 7, 2026Kohga Tanaka, Hiroaki NishiNeural Network InferenceCompressed Model

  20. Neural Network Compression by Approximate Differential Equivalence

    May 31, 2026Ravi Dhiman, Andrea Passarella, Mirco Tribastone +1Compressed ModelNeural Approximations

  21. Automatically Differentiable Nonlinear Tensor Networks (ADNTNs) for Exponential Parameter Compression of Deep Neural Networks

    May 28, 2026Andrzej Cichocki, Michal WietczakTensor NetworksCompressed Model

  22. KLAS: Using Similarity to Stitch Neural Networks for Improved Accuracy-Efficiency Tradeoffs

    May 28, 2026Debopam Sanyal, Anantharaman Iyer, Alind Khare +5Capability-Speed Trade-OffsImagenet

  23. FTerViT: Fully Ternary Vision Transformer

    May 20, 2026Szymon Ruciński, Pietro Bonazzi, Engin Türetken +3Self-Supervised Vision TransformersVision Transformer

  24. Dynamic Model Merging Made Slim

    May 17, 2026Guodong Du, Wanyu LinContinual Model MergingMixture-Of-Experts Architectures

  25. Complexity Horizons of Compressed Models in Analog Circuit Analysis

    May 4, 2026Pacome Simon MbonimpaCompressed ModelAnalog Design

  26. Hierarchical Spatio-Channel Clustering for Efficient Model Compression in Medical Image Analysis

    Apr 25, 2026Sisipho Hamlomo, Marcellin Atemkeng, Habte Tadesse Likassa +5Compressed ModelLow-Rank Structure

  27. TStore: Rethinking AI Model Hub with Tensor-Centric Compression

    Apr 18, 2026Tingfeng Lan, Zirui Wang, Yunjia Zheng +3Compressed ModelArtificial Intelligence Models

  28. On the Interaction of Compressibility and Adversarial Robustness

    Jul 23, 2025Melih Barsbey, Antônio H. Ribeiro, Umut Şimşekli +1Compressed ModelData Compression Methods

  29. GeLaCo: An Evolutionary Approach to Layer Compression

    Jul 14, 2025David Ponce, Thierry Etchegoyhen, Javier Del SerLarge Language Model CompressionCompressed Model

  30. Tensorization is a powerful but underexplored tool for compression and interpretability of neural networks

    May 26, 2025Safa Hamreras, Sukhbinder Singh, Román OrúsTensor NetworksNeural Network

  31. DarwinLM: Evolutionary Structured Pruning of Large Language Models

    Feb 11, 2025Shengkun Tang, Oliver Sieberling, Eldar Kurtic +2Large Language Model CompressionUnstructured Pruning