Neural Network Compression

Latest papers 128

All topics
CardsList
  1. NeuralZip: Reusable Setup for Fast Lossless Compression

    Oct 7, 2026Martín Bravo, Samuel Horváth, Gonzalo Navarro +1Neural Network CompressionEntropy Coding

  2. CHASE: Channel-Aligned Structure Exploitation for Geometry-Aware Model Engineering

    Oct 7, 2026Wei Wang, Wei Jiang, Ziran LiuNeural Network CompressionKV-Cache Compression

  3. Task-Aware Joint Pruning and Distillation for Efficient Audio Deepfake Detection

    Oct 4, 2026Miao He, Peng Cheng, Zhongjie Ba +4Audio Deepfake DetectionKnowledge Distillation

  4. Learning Functional Subspaces for Neural Network Compression

    Sep 30, 2026Massimo Bini, Anders Christensen, Stephan Alaniz +5LLM CompressionLow-Rank Matrix Decomposition

  5. A Tilted Bowl Is Not a Slippery Slope: Compressing Looped Models

    Sep 30, 2026Steven Kolawole, Pearse Jim, Opegbemi M. Busoye +2Efficient Neural Network InferenceRecurrent Neural Networks

  6. Security-Enhanced Seed-Based Weight Quantization for Large Language Models

    Sep 29, 2026Qiuyu Ren, Sudipta Paria, Aritra Dasgupta +1LLM QuantizationLLM Compression

  7. Hardware-Aware Functional Kolmogorov-Arnold Networks for Efficient Medical Image Enhancement and Segmentation

    Sep 28, 2026Mohammad Sadegh SirjaniEfficient Neural Network InferenceKolmogorov-Arnold Networks

  8. P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

    Sep 28, 2026Haizhao Jing, Zhenhao Shang, Haokui Zhang +2VLM QuantizationEfficient VLM Inference

  9. One Latent, Many Tokens: Jointly Learning Compressed Embeddings for Efficient Language Diffusion

    Sep 27, 2026Yulin Yuan, Ying Zhang, Xiangming MengDiffusion Language Model InferenceDiffusion Language Models

  10. GeoPair: Geometry-Preserving Cross-Layer Factorization for Training-Free Transformer Compression

    Sep 22, 2026Baher Mohammad, Ammar Ali, Stamatios LefkimmiatisModel CompressionLow-Rank Compression

  11. A Smaller Transformer in Your Transformer

    Sep 17, 2026Dhananjay Tomar, Marius Aasan, Andreas Kleppe +1Transformer InferenceVision Transformer

  12. Multi-Agent Learning with Cooperation-Driven Optimization Dynamics

    Sep 15, 2026Jarod Ketcha Kouakep, Sreyvi UANN, Timoteo CarlettiMultilayer PerceptronsNeural Network Optimization

  13. Dense Structural Compression of Transformers via Gauge-Correct Channel Removal

    Sep 7, 2026Jed A. Duersch, Naïm Es-Sebbani, Nathanaël Haas +1Efficient Transformer InferenceStructured Pruning

  14. Mind the Approximation: Fisher-Weighted SVD Compression for ViTs

    Sep 7, 2026Moritz Thoma, Maximilian Groezinger, Maximilian Forstenhäusler +7Efficient ViTsLow-Rank Compression

  15. TAP-Path: Task-Adaptive Structural and Token Pruning for Efficient and Trustworthy Pathology Foundation Models

    Sep 3, 2026Mehedi Hasan, Ashfak Yeafi, Md Khairul IslamComputational PathologyPathology Foundation Models

  16. H3DNAS: Hardware-Aware ONNX-Native 3D Point Cloud Model Compression

    Sep 2, 2026Anchit Mulye, Rhythm Baghel, Sujay Kumar Ingle +1Neural Network CompressionHardware-Aware NAS

  17. Emergence of Fibrations, Compression, and Symmetry Breaking in Artificial Neural Networks

    Sep 1, 2026Osvaldo M Velarde, Lucas C Parra, Alireza Hashemi +1Neural Network InterpretabilityNeural Network Compression

  18. Linear Reusable Neural Bases Architecture for Network Compression

    Sep 1, 2026Binshuai Wang, Peng Wei, Mahyar GhazanfariNeural Network Compression

  19. A Closed-Loop Evaluation of Capability Loss and Recovery in Compressed Driving Policies

    Sep 1, 2026Ahmad Alfan Alfian Irfan, Nur Ahmad Khatim, Mansur AriefAutonomous Driving Safety EvaluationKnowledge Distillation

  20. A hybrid quantum-classical neural network for learning to route

    Aug 31, 2026Marcus Rolf Peter Ritt, Alexsandro Santos da Rosa Júnior, Marcos Vinicius Reballo +2Hybrid Quantum-Classical MLVehicle Routing

  21. Sharp Approximation Rates for Neural Networks with Affine Latent Parameterizations

    Aug 31, 2026Shijun ZhangHypernetworksNeural Network Approximation Theory

  22. Functional Degeneracy in Neural Networks: Measurement and Pruning

    Aug 31, 2026Maria Matveev, Pascal Esser, Ayush Bharadwaj +2Structured PruningNeural Network Compression

  23. Multivariate Scientific Data Compression with Learned Cross-Variable Latent Decorrelation and Autoregressive Entropy Modeling

    Aug 31, 2026Liangji Zhu, Anand Rangarajan, Sanjay RankaNeural Network CompressionAutoregressive Modeling

  24. Selection, Representation, and Execution in Sparse Fourier Neural Operators

    Aug 30, 2026Abdul Qadir Ibrahim, Martin BurgerEfficient Neural Network InferenceFourier Neural Operator

  25. Breaking the Compression Barrier: Cross-Architecture Compression Boundary Learning via Reverse Regrowth

    Aug 17, 2026Zhaocen Liu, Satvik Praveen, Yi ShengNeural Network CompressionNeural Network Pruning

  26. HYDRA: Hyperbolic Dynamic Representation Architecture for Kolmogorov-Arnold Networks

    Aug 12, 2026Zhao Su, Yuxin Xia, Haoran Li +4Kolmogorov-Arnold NetworksNeural Network Approximation Theory

  27. Lossless Tensor Compression as Program Synthesis

    Aug 3, 2026Jieke Shi, Junda He, Wenjia Jiang +11Model CompressionProgram Synthesis