Neural Network Quantization

Latest papers 270

All topics
CardsList
  1. Taming the Security-Energy Paradox: A Green AI Approach to Optimized Android Malware Detection

    Jul 22, 2026Shrinidhi Sridhar, Vikas K. MalviyaEnergy-Efficient MLAndroid Malware Detection

  2. Contraction-Gauge Preconditioning for Quantized Matrix Multiplication

    Jul 21, 2026Piyush Sao, Narasinga Miniskar, Pedro Valero-Lara +2Post-Training QuantizationLow-Bit Quantization

  3. Recti-Q: Feature-Space Rectification for Out-of-Distribution-Robust Quantized Perception in Edge Robotics

    Jul 20, 2026Hamidreza Yaghoubi Araghi, Parastoo Pilevar, Ming C. LinDistribution Shift RobustnessImage Corruption Robustness

  4. MXSens: Sensitivity-Aware Mixed-Precision Quantization for Efficient LLM Inference

    Jul 20, 2026Simla Burcu Harma, Danila Mishin, Zhengyuan Su +7Mixed-Precision QuantizationLLM Quantization

  5. Toward Energy-Efficient and Low-Power Arrhythmia Detection for Wearable Devices

    Jul 16, 2026Floriaan Bulten, Yawar Rasheed, Arlene John +2Energy-Efficient MLElectrocardiogram Classification

  6. Saturation Makes Quantization Error Additive: A Coverage Model with a Certificate

    Jul 14, 2026Joshua HillMixed-Precision QuantizationLLM Quantization

  7. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

    Jul 9, 2026Baha Rababah, Cuneyt Gurcan Akcora, Carson K. LeungLLM EvaluationPost-Training Quantization

  8. It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement

    Jul 9, 2026Zahra Benslimane, Pierre Chouteau, Martyna Poreba +4Quantization-Aware TrainingSpeech Enhancement

  9. Closing the Null Space: Guidance-Aware Quantization for Classifier-Free Diffusion

    Jul 9, 2026Abdullah Al Shafi, Sumaiya Rahim SumaMixed-Precision QuantizationClassifier-Free Guidance

  10. KronQ: LLM Quantization via Kronecker-Factored Hessian

    Jul 8, 2026Donghyun Lee, Yuhang Li, Ruokai Yin +1Mixed-Precision QuantizationLLM Quantization

  11. Lyapunov-Guided Training for Hardware-Safe Neural Networks Under Fixed-Point Arithmetic

    Jul 5, 2026Anis Hamadouche, Amir HussainLyapunov-Based ControlQuantization-Aware Training

  12. Full-Stack FP4: Stable LLM Pretraining with Quantized Projections, Optimizers, and Attention

    Jul 5, 2026Siyu Ding, Mingchuan Ma, Jiabo Tong +3Language Model PretrainingMixed-Precision Quantization

  13. A Unified Framework for Quantized and Continuous Strong Lottery Tickets

    Jul 4, 2026Aakash Kumar, Emanuele NataleNeural Network Approximation TheoryNeural Network Quantization

  14. ELiTeFormer: An Efficient Transformer for FPGAs

    Jul 4, 2026Victor Agostinelli, Nicolas Bohm Agostini, Antonino TumeoLLM QuantizationTernary Quantization

  15. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

    Jul 2, 2026Donghyun Lee, Jitesh Chavan, Duy Nguyen +5Video Diffusion ModelsDiffusion Transformer

  16. Boundary-Aware Quantization: Finite-Scale Decision Geometry of Neural Classifiers

    Jul 1, 2026O. M. KiselevWeight-Only QuantizationPost-Training Quantization

  17. Logb\text{Log}_\text{b}Quant: Quantizing Language Models in Logarithmic Space

    Jul 1, 2026Jeremias Bohn, Tizian Dippold, Mahdi Koubaa +2LLM Quantization4-Bit Quantization

  18. Beyond Activation Alignment:The Alignment-Diversity Tradeoff in Task-Aware LLM Quantization

    Jul 1, 2026Fei Wang, Chao Xue, Taoran Liu +3Mixed-Precision QuantizationLLM Quantization

  19. Zero-Shot Quantization for Object Detectors using Off-the-Shelf Generative Models

    Jun 30, 2026Hyunho Lee, Kyomin Hwang, Hyeonjin Kim +3Quantization-Aware TrainingSynthetic Data Generation

  20. SEADA: An efficient methodology for optimizing mixed-precision DNNs on multi-precision spatial architectures

    Jun 26, 2026Leandro Fiorin, Marco Ronzani, Cristina SilvanoMixed-Precision QuantizationEfficient Neural Network Inference

  21. Learning 1-Bit LiDAR-based Localization with Auxiliary Objective

    Jun 26, 2026Kaijie Yin, Zhiyuan Zhang, Tian Gao +3Binary Neural NetworksLiDAR Localization

  22. Quantization in Federated Learning: Methods, Challenges and Future Directions

    Jun 25, 2026Farwa Ikram, Dipanwita Thakur, Antonella Guzzo +1Neural Network QuantizationFederated Learning