Neural Network Compression

Latest papers 128

All topics
CardsList
  1. NeuralZip: Reusable Setup for Fast Lossless Compression

    Oct 7, 2026Martín Bravo, Samuel Horváth, Gonzalo Navarro +1Neural Network CompressionEntropy Coding

  2. CHASE: Channel-Aligned Structure Exploitation for Geometry-Aware Model Engineering

    Oct 7, 2026Wei Wang, Wei Jiang, Ziran LiuNeural Network CompressionKV-Cache Compression

  3. Task-Aware Joint Pruning and Distillation for Efficient Audio Deepfake Detection

    Oct 4, 2026Miao He, Peng Cheng, Zhongjie Ba +4Audio Deepfake DetectionKnowledge Distillation

  4. Learning Functional Subspaces for Neural Network Compression

    Sep 30, 2026Massimo Bini, Anders Christensen, Stephan Alaniz +5LLM CompressionLow-Rank Matrix Decomposition

  5. A Tilted Bowl Is Not a Slippery Slope: Compressing Looped Models

    Sep 30, 2026Steven Kolawole, Pearse Jim, Opegbemi M. Busoye +2Efficient Neural Network InferenceRecurrent Neural Networks

  6. Security-Enhanced Seed-Based Weight Quantization for Large Language Models

    Sep 29, 2026Qiuyu Ren, Sudipta Paria, Aritra Dasgupta +1LLM QuantizationLLM Compression

  7. Hardware-Aware Functional Kolmogorov-Arnold Networks for Efficient Medical Image Enhancement and Segmentation

    Sep 28, 2026Mohammad Sadegh SirjaniEfficient Neural Network InferenceKolmogorov-Arnold Networks

  8. P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

    Sep 28, 2026Haizhao Jing, Zhenhao Shang, Haokui Zhang +2VLM QuantizationEfficient VLM Inference

  9. One Latent, Many Tokens: Jointly Learning Compressed Embeddings for Efficient Language Diffusion

    Sep 27, 2026Yulin Yuan, Ying Zhang, Xiangming MengDiffusion Language Model InferenceDiffusion Language Models

  10. GeoPair: Geometry-Preserving Cross-Layer Factorization for Training-Free Transformer Compression

    Sep 22, 2026Baher Mohammad, Ammar Ali, Stamatios LefkimmiatisModel CompressionLow-Rank Compression

  11. A Smaller Transformer in Your Transformer

    Sep 17, 2026Dhananjay Tomar, Marius Aasan, Andreas Kleppe +1Transformer InferenceVision Transformer

  12. Multi-Agent Learning with Cooperation-Driven Optimization Dynamics

    Sep 15, 2026Jarod Ketcha Kouakep, Sreyvi UANN, Timoteo CarlettiMultilayer PerceptronsNeural Network Optimization

  13. Dense Structural Compression of Transformers via Gauge-Correct Channel Removal

    Sep 7, 2026Jed A. Duersch, Naïm Es-Sebbani, Nathanaël Haas +1Efficient Transformer InferenceStructured Pruning

  14. Mind the Approximation: Fisher-Weighted SVD Compression for ViTs

    Sep 7, 2026Moritz Thoma, Maximilian Groezinger, Maximilian Forstenhäusler +7Efficient ViTsLow-Rank Compression

  15. TAP-Path: Task-Adaptive Structural and Token Pruning for Efficient and Trustworthy Pathology Foundation Models

    Sep 3, 2026Mehedi Hasan, Ashfak Yeafi, Md Khairul IslamComputational PathologyPathology Foundation Models

  16. H3DNAS: Hardware-Aware ONNX-Native 3D Point Cloud Model Compression

    Sep 2, 2026Anchit Mulye, Rhythm Baghel, Sujay Kumar Ingle +1Neural Network CompressionHardware-Aware NAS

  17. Emergence of Fibrations, Compression, and Symmetry Breaking in Artificial Neural Networks

    Sep 1, 2026Osvaldo M Velarde, Lucas C Parra, Alireza Hashemi +1Neural Network InterpretabilityNeural Network Compression

  18. Linear Reusable Neural Bases Architecture for Network Compression

    Sep 1, 2026Binshuai Wang, Peng Wei, Mahyar GhazanfariNeural Network Compression

  19. A Closed-Loop Evaluation of Capability Loss and Recovery in Compressed Driving Policies

    Sep 1, 2026Ahmad Alfan Alfian Irfan, Nur Ahmad Khatim, Mansur AriefAutonomous Driving Safety EvaluationKnowledge Distillation

  20. A hybrid quantum-classical neural network for learning to route

    Aug 31, 2026Marcus Rolf Peter Ritt, Alexsandro Santos da Rosa Júnior, Marcos Vinicius Reballo +2Hybrid Quantum-Classical MLVehicle Routing

  21. Sharp Approximation Rates for Neural Networks with Affine Latent Parameterizations

    Aug 31, 2026Shijun ZhangHypernetworksNeural Network Approximation Theory

  22. Functional Degeneracy in Neural Networks: Measurement and Pruning

    Aug 31, 2026Maria Matveev, Pascal Esser, Ayush Bharadwaj +2Structured PruningNeural Network Compression

  23. Multivariate Scientific Data Compression with Learned Cross-Variable Latent Decorrelation and Autoregressive Entropy Modeling

    Aug 31, 2026Liangji Zhu, Anand Rangarajan, Sanjay RankaNeural Network CompressionAutoregressive Modeling

  24. Selection, Representation, and Execution in Sparse Fourier Neural Operators

    Aug 30, 2026Abdul Qadir Ibrahim, Martin BurgerEfficient Neural Network InferenceFourier Neural Operator

  25. Breaking the Compression Barrier: Cross-Architecture Compression Boundary Learning via Reverse Regrowth

    Aug 17, 2026Zhaocen Liu, Satvik Praveen, Yi ShengNeural Network CompressionNeural Network Pruning

  26. HYDRA: Hyperbolic Dynamic Representation Architecture for Kolmogorov-Arnold Networks

    Aug 12, 2026Zhao Su, Yuxin Xia, Haoran Li +4Kolmogorov-Arnold NetworksNeural Network Approximation Theory

  27. Lossless Tensor Compression as Program Synthesis

    Aug 3, 2026Jieke Shi, Junda He, Wenjia Jiang +11Model CompressionProgram Synthesis

  28. Simplifying Neural Networks During Training

    Jul 30, 2026Lorenzo Sciandra, Samuele Fonio, Roberto EspositoNeural Network Training DynamicsNeural Network Compression

  29. SPRKD: Effective Knowledge Distillation for Deep Neural Networks via Saddle Region Approximation

    Jul 25, 2026Aditya Dewan, Arjun Yogeswaran, Benjamin FedorukKnowledge DistillationNeural Network Compression

  30. Neural Network-Driven Volatility Drag Mitigation under Aggressive Leverage

    Jul 25, 2026Christian Bongiorno, Efstratios Manolakis, Rosario Nunzio MantegnaPortfolio OptimizationNeural Network Compression

  31. Neural Feature Governance: Extending Atom Prevalence

    Jul 23, 2026Idris Karel Seunda Ekwe, Patrick Tenga Shako, Ernest Parfait FokouéBayesian Neural NetworksUncertainty Quantification

  32. Importance-Aware OBS Pruning for Diffusion Models

    Jul 22, 2026Ba-Thinh Lam, Srijan Das, Hieu LeNeural Network CompressionNeural Network Pruning

  33. ECoNGS: Efficient Compressive Neural Gaussian Splats for Volume Visualization

    Jul 20, 2026Kaiyuan Tang, Chaoli Wang3DGS CompressionScientific Visualization

  34. Efficient Audio-Visual Event Recognition via Knowledge Distillation and Dynamic INT8 Quantization of a Hybrid Cross-Attention Network

    Jul 18, 2026Parinaz Binandeh Dehaghani, Danilo Pena, A. Pedro AguiarAudio-Visual UnderstandingNeural Network Compression

  35. GB-SVFBP: Gaussian-Based Shift-Variant FBP neural network

    Jul 13, 2026Chengze Ye, Linda-Sophie Schneider, Yipeng Sun +1Cone-Beam CTImage Reconstruction

  36. CARE-LoRA: Compressed Activation REconstruction for Memory-Efficient LoRA

    Jul 11, 2026Gengyu Zhang, Haiyin Ran, Zhengbao He +4Fine-TuningMemory-Efficient Fine-Tuning

  37. EvoLP: Self-Evolving Latency Predictor for Model Compression in Real-Time Edge Systems

    Jul 10, 2026Shuo Huai, Hao Kong, Shiqing Li +5Efficient Neural Network InferenceEdge Computing

  38. SLORR: Simple and Efficient In-Training Low-Rank Regularization

    Jul 9, 2026David González-Martínez, Shiwei LiuLLM CompressionLow-Rank Matrix Decomposition

  39. It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement

    Jul 9, 2026Zahra Benslimane, Pierre Chouteau, Martyna Poreba +4Quantization-Aware TrainingSpeech Enhancement

  40. EdgeCompress: Coupling Multidimensional Model Compression and Dynamic Inference for EdgeAI

    Jul 8, 2026Hao Kong, Di Liu, Shuo Huai +5Edge InferenceConvolutional Neural Networks

  41. Smart Scissor: Coupling Spatial Redundancy Reduction and CNN Compression for Embedded Hardware

    Jul 8, 2026Hao Kong, Di Liu, Shuo Huai +5Efficient Neural Network InferenceEdge Inference

  42. Enhancing deep learning models for time series classification via knowledge distillation

    Jul 7, 2026Javidan Abdullayev, Maxime Devanne, Jonathan Weber +1Time Series ClassificationKnowledge Distillation

  43. Empirical Minimal-Realisation Compression of Deep Neural Networks via Controllability-Observability Tests

    Jul 5, 2026Anis Hamadouche, Amir HussainReduced-Order ModelingNeural Network Compression

  44. Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

    Jul 1, 2026Jaeah Lee, Hyunjin Kim, Jaewoong Cho +1Model CompressionDiffusion Transformer

  45. HASTE: A Framework for Training-Free, Dynamic, and Steerable Compression of Pre-Trained Convolutional Neural Networks

    Jun 29, 2026Lukas Meiner, Jens Mehnert, Alexandru Paul ConduracheEfficient Neural Network InferenceConvolutional Neural Networks

  46. DTM-Codec: Dynamic Token Masking for VFR Speech Coding with Efficient Boundary Selection

    Jun 28, 2026Hoyeol Sohn, Juhan NamNeural Audio CodecsNeural Network Compression

  47. Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding

    Jun 25, 2026Dimitrios Bralios, Paris Smaragdis, Minje KimNeural Audio CodecsAutoencoders

  48. Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization

    Jun 24, 2026Kamar Hibatallah Baghdadi, Kawther Guoual Belhamidi, Sara Belhadj +2Hierarchical RLNeural Network Quantization

  49. Hybrid Compression: Integrating Pruning and Quantization for Optimized Neural Networks

    Jun 22, 2026Minh-Loi Nguyen, Long-Bao Nguyen, Van-Hieu Huynh +2Model CompressionEfficient Neural Network Inference

  50. Activation- and Influence-Aware Ranks (AIR): Function-Preserving SVD Compression for LLMs

    Jun 18, 2026Nico Harder, Daniel Becking, Karsten Mueller +1LLM CompressionLow-Rank Matrix Decomposition

  51. Operator Boosting Produces Pareto-Efficient PDE Surrogates

    Jun 16, 2026Lennon J. ShikhmanPDE Surrogate ModelingDeep Operator Networks