Neural Network Compression

Latest papers 128

All topics
CardsList
  1. Context-Aware Markov VAE for CSI Compression in Wireless Systems

    Jun 15, 2026Efstathios Chatziloizos, Konstantinos Vandikas, Aneta Vulgarakis Feljan +2Variational AutoencodersNeural Network Compression

  2. Mixtures of Subspaces for Bandwidth Efficient Context Parallel Training

    Jun 15, 2026Sameera Ramasinghe, Ajanthan Thalaiyasingam, Hadi Mohaghegh Dolatabadi +5Communication-Efficient Distributed TrainingLong-Context Language Modeling

  3. Embedded Arena: Iterative Optimization via Hardware Feedback

    Jun 15, 2026Zhihan Zhang, Alexander Le Metzger, Jiuyang Lyu +10Large Language Model-Guided OptimizationTiny ML

  4. AQ4SViT: An Automated Quantization Framework with Search Gating Policy for Compressing Spiking Vision Transformers

    Jun 14, 2026Rachmad Vidya Wicaksana Putra, Saad Iftikhar, Muhammad ShafiqueSpiking TransformersNeural Network Quantization

  5. Improved Knowledge Distillation for Land-Use Image Classification

    Jun 12, 2026Arundhuti Sur, Abhiroop Chatterjee, Susmita Ghosh +1Cross-Architecture Knowledge DistillationKnowledge Distillation

  6. VQ4SNN: Vector Quantization for Memory-Efficient FPGA Spiking Neural Networks

    Jun 12, 2026Dimitrios Sekertzis, Giorgos DimitrakopoulosMemory-Efficient InferenceVector Quantization

  7. Squeeze-Release: Iterative Pruning with Exact Structural Minimization

    Jun 12, 2026Roman Denkin, Ida Akerholm, Prashant Singh +1Structured PruningNeural Network Compression

  8. Reducing the Complexity of Deep Learning Models for EEG Analysis on Wearable Devices

    Jun 10, 2026Farough Shayeste Roodi, Parham Zilouchian Moghaddam, Mahdi Mohammadi-nasab +3ElectroencephalographyEEG Seizure Detection

  9. Towards Data-free and Training-free Compression for Speech Foundation Models Using Parameter Clustering

    Jun 10, 2026Haoning Xu, Zhaoqing Li, Huimeng Wang +4Speech Foundation ModelsClustering

  10. How Much Capacity Does EEG Denoising Need? Ultra-Compact Networks reveal Benchmark Saturation and Metric-Utility Gap

    Jun 7, 2026Jasmeet Singh Bindra, Siddharth PanwarElectroencephalographyNeural Network Compression

  11. Joint Structural Pruning and Mixed-Precision Quantization for LLM Compression

    Jun 5, 2026Hoang-Loc La, Truong-Thanh Le, Amir Taherkordi +1Mixed-Precision QuantizationLLM Quantization

  12. Learned Subspace Compression for Communication-Efficient Pipeline Parallelism

    Jun 3, 2026Paul Janson, Edouard Oyallon, Eugene BelilovskyLLM CompressionCommunication-Efficient Distributed Training

  13. Data Efficient Complex Feature Fusion Network For Hyperspectral Image Classification

    Jun 3, 2026Maitreya Shelare, Atharva Satam, Poonam Sonar +1Efficient Neural Network InferenceComplex-Valued Neural Networks

  14. PrimeSVT: An Automated Memory-aware Pruning Framework with Prioritized Compression Policy for Spiking Vision Transformers

    Jun 2, 2026Rachmad Vidya Wicaksana Putra, Achyuta Muthuvelan, Alberto Marchisio +1Memory-Efficient InferenceSpiking Neural Networks

  15. Neural Network Compression by Approximate Differential Equivalence

    May 31, 2026Ravi Dhiman, Andrea Passarella, Mirco Tribastone +1Neural Network Compression

  16. Structured Neuron Pruning in Deep Neural Networks Using Multi-Armed Bandits

    May 29, 2026Salem Ameen, Sunil VaderaMulti-Armed BanditsNeural Network Compression

  17. Automatically Differentiable Nonlinear Tensor Networks (ADNTNs) for Exponential Parameter Compression of Deep Neural Networks

    May 28, 2026Andrzej Cichocki, Michal WietczakTensor NetworksNeural Network Compression

  18. Semantic Optimal Transport for Sparse Autoencoder Feature Matching and Circuit Compression

    May 27, 2026Tue M. Cao, Nguyen Do, My T. ThaiSparse AutoencodersMechanistic Interpretability

  19. Recursive Vision Transformer with Dynamic Depth and Width Adjustment for Resource-Efficient Image Semantic Communication

    May 27, 2026Zhilong Zhang, Xinhui Zhang, Gongyu Jin +3Dynamic Neural NetworksSemantic Communication

  20. MTL-FNO: A Lightweight Multi-Task Fourier Neural Operator for Sparse Field Reconstruction

    May 26, 2026Siyu Ye, Shihang Li, Zhiqiang Gong +4Fourier Neural OperatorMulti-Task Learning

  21. Relative Repairability: A Calibration-Based Diagnostic for High-Sparsity Post-Pruning Allocation

    May 25, 2026Qishi Zhan, Liang He, Minxuan Hu +1Neural Network CompressionNeural Network Pruning

  22. A general tensor-structured compression scheme for efficient large language models

    May 25, 2026Ying Lu, Peng-Fei Zhou, Qi-Xuan Fang +3LLM Inference EfficiencyLLM Compression

  23. Motion-Compensated Weight Compression

    May 23, 2026Ismail LamaakalPredictive CodingWeight-Only Quantization

  24. Slimmable ConvNeXt: Width-Adaptive Inference for Efficient Multi-Device Deployment

    May 21, 2026Janek Haberer, Jon Eike Wilhelm, Olaf LandsiedelEfficient Neural Network InferenceAdaptive Inference

  25. Partial Fusion of Neural Networks: Efficient Tradeoffs Between Ensembles and Weight Aggregation

    May 21, 2026Fabian Morelli, Stephan EcksteinInverse Optimal TransportEnsemble Learning

  26. Adaptive Signal Resuscitation: Channel-wise Post-Pruning Repair for Sparse Vision Networks

    May 20, 2026Qishi Zhan, Ziheng Chen, Minxuan HuNeural Network CompressionNeural Network Pruning

  27. Fast Tensorization of Neural Networks via Slice-wise Feature Distillation

    May 19, 2026Safa Hamreras, Sukhbinder Singh, Román OrúsTensor NetworksTensor Decomposition

  28. Replacement Learning: Training Neural Networks with Fewer Parameters

    May 19, 2026Yuming Zhang, Peizhe Wang, Tianyang Han +5Deep Learning OptimizationNeural Network Compression