Neural Network Compression

Latest papers 128

All topics
CardsList
  1. Simplifying Neural Networks During Training

    Jul 30, 2026Lorenzo Sciandra, Samuele Fonio, Roberto EspositoNeural Network Training DynamicsNeural Network Compression

  2. SPRKD: Effective Knowledge Distillation for Deep Neural Networks via Saddle Region Approximation

    Jul 25, 2026Aditya Dewan, Arjun Yogeswaran, Benjamin FedorukKnowledge DistillationNeural Network Compression

  3. Neural Network-Driven Volatility Drag Mitigation under Aggressive Leverage

    Jul 25, 2026Christian Bongiorno, Efstratios Manolakis, Rosario Nunzio MantegnaPortfolio OptimizationNeural Network Compression

  4. Neural Feature Governance: Extending Atom Prevalence

    Jul 23, 2026Idris Karel Seunda Ekwe, Patrick Tenga Shako, Ernest Parfait FokouéBayesian Neural NetworksUncertainty Quantification

  5. Importance-Aware OBS Pruning for Diffusion Models

    Jul 22, 2026Ba-Thinh Lam, Srijan Das, Hieu LeNeural Network CompressionNeural Network Pruning

  6. ECoNGS: Efficient Compressive Neural Gaussian Splats for Volume Visualization

    Jul 20, 2026Kaiyuan Tang, Chaoli Wang3DGS CompressionScientific Visualization

  7. Efficient Audio-Visual Event Recognition via Knowledge Distillation and Dynamic INT8 Quantization of a Hybrid Cross-Attention Network

    Jul 18, 2026Parinaz Binandeh Dehaghani, Danilo Pena, A. Pedro AguiarAudio-Visual UnderstandingNeural Network Compression

  8. GB-SVFBP: Gaussian-Based Shift-Variant FBP neural network

    Jul 13, 2026Chengze Ye, Linda-Sophie Schneider, Yipeng Sun +1Cone-Beam CTImage Reconstruction

  9. CARE-LoRA: Compressed Activation REconstruction for Memory-Efficient LoRA

    Jul 11, 2026Gengyu Zhang, Haiyin Ran, Zhengbao He +4Fine-TuningMemory-Efficient Fine-Tuning

  10. EvoLP: Self-Evolving Latency Predictor for Model Compression in Real-Time Edge Systems

    Jul 10, 2026Shuo Huai, Hao Kong, Shiqing Li +5Efficient Neural Network InferenceEdge Computing

  11. SLORR: Simple and Efficient In-Training Low-Rank Regularization

    Jul 9, 2026David González-Martínez, Shiwei LiuLLM CompressionLow-Rank Matrix Decomposition

  12. It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement

    Jul 9, 2026Zahra Benslimane, Pierre Chouteau, Martyna Poreba +4Quantization-Aware TrainingSpeech Enhancement

  13. EdgeCompress: Coupling Multidimensional Model Compression and Dynamic Inference for EdgeAI

    Jul 8, 2026Hao Kong, Di Liu, Shuo Huai +5Edge InferenceConvolutional Neural Networks

  14. Smart Scissor: Coupling Spatial Redundancy Reduction and CNN Compression for Embedded Hardware

    Jul 8, 2026Hao Kong, Di Liu, Shuo Huai +5Efficient Neural Network InferenceEdge Inference

  15. Enhancing deep learning models for time series classification via knowledge distillation

    Jul 7, 2026Javidan Abdullayev, Maxime Devanne, Jonathan Weber +1Time Series ClassificationKnowledge Distillation

  16. Empirical Minimal-Realisation Compression of Deep Neural Networks via Controllability-Observability Tests

    Jul 5, 2026Anis Hamadouche, Amir HussainReduced-Order ModelingNeural Network Compression

  17. Vitality-Aware Compression for Efficient Image-to-Shape Diffusion Transformers

    Jul 1, 2026Jaeah Lee, Hyunjin Kim, Jaewoong Cho +1Model CompressionDiffusion Transformer

  18. HASTE: A Framework for Training-Free, Dynamic, and Steerable Compression of Pre-Trained Convolutional Neural Networks

    Jun 29, 2026Lukas Meiner, Jens Mehnert, Alexandru Paul ConduracheEfficient Neural Network InferenceConvolutional Neural Networks

  19. DTM-Codec: Dynamic Token Masking for VFR Speech Coding with Efficient Boundary Selection

    Jun 28, 2026Hoyeol Sohn, Juhan NamNeural Audio CodecsNeural Network Compression

  20. Elastic Time: Dynamic Frame Rate Bottlenecks for Neural Audio Coding

    Jun 25, 2026Dimitrios Bralios, Paris Smaragdis, Minje KimNeural Audio CodecsAutoencoders

  21. Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization

    Jun 24, 2026Kamar Hibatallah Baghdadi, Kawther Guoual Belhamidi, Sara Belhadj +2Hierarchical RLNeural Network Quantization

  22. Hybrid Compression: Integrating Pruning and Quantization for Optimized Neural Networks

    Jun 22, 2026Minh-Loi Nguyen, Long-Bao Nguyen, Van-Hieu Huynh +2Model CompressionEfficient Neural Network Inference

  23. Activation- and Influence-Aware Ranks (AIR): Function-Preserving SVD Compression for LLMs

    Jun 18, 2026Nico Harder, Daniel Becking, Karsten Mueller +1LLM CompressionLow-Rank Matrix Decomposition

  24. Operator Boosting Produces Pareto-Efficient PDE Surrogates

    Jun 16, 2026Lennon J. ShikhmanPDE Surrogate ModelingDeep Operator Networks