Low-Bit Quantization

Momentum

21 papers in the last four weeks, up 62% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 155

All topics
CardsList
  1. It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement

    Jul 9, 2026Zahra Benslimane, Pierre Chouteau, Martyna Poreba +4Quantization-Aware TrainingSpeech Enhancement

  2. BiSCo-LLM: Lookup-Free Binary Spherical Coding for Extreme Low-Bit Large Language Model Compression

    Jul 9, 2026Yuantian Shao, Peisong Wang, Zhilei Liu +6LLM CompressionWeight-Only Quantization

  3. The Silent Freeze: Predicting When Low-Precision Training Stops Learning

    Jul 9, 2026Zekai ShangNeural Network Training DynamicsLow-Bit Quantization

  4. GeoFP8: Geometry-Aware FP8 Gradient Compression for Distributed LLM Training

    Jul 8, 2026Jieying Wang, Zizhong Wang, Fangru Linghu +3Language Model PretrainingCommunication-Efficient Distributed Training

  5. Lyapunov-Guided Training for Hardware-Safe Neural Networks Under Fixed-Point Arithmetic

    Jul 5, 2026Anis Hamadouche, Amir HussainLyapunov-Based ControlQuantization-Aware Training

  6. Logb\text{Log}_\text{b}Quant: Quantizing Language Models in Logarithmic Space

    Jul 1, 2026Jeremias Bohn, Tizian Dippold, Mahdi Koubaa +2LLM Quantization4-Bit Quantization

  7. GSRQ: Gain-Shape Residual Quantization for Sub-1-bit KV Cache

    Jul 1, 2026Soosung Kim, Minjae Park, Eui-Young Chung +1LLM CompressionResidual VQ

  8. Zero-Shot Quantization for Object Detectors using Off-the-Shelf Generative Models

    Jun 30, 2026Hyunho Lee, Kyomin Hwang, Hyeonjin Kim +3Quantization-Aware TrainingSynthetic Data Generation

  9. BitNet Text Embeddings

    Jun 24, 2026Zhen Li, Xin Huang, Liang Wang +8LLM QuantizationEmbedding Compression

  10. RoPE-Aware Bit Allocation for KV-Cache Quantization

    Jun 23, 2026Fengfeng Liang, Yuechen Zhang, Jiaya JiaKV CachingLLM Inference Acceleration

  11. On the Expressive Power of Weight Quantization in Large Language Models

    Jun 20, 2026Shao-Qun ZhangLLM QuantizationWeight-Only Quantization

  12. An Empirical Study of OpenPangu Quantization on Ascend NPUs

    Jun 19, 2026Tong Shi, Jiacheng Wang, Hui Xie +4LLM QuantizationAI Accelerator Inference

  13. SPARK: Spatial Policy-driven Adaptive Reinforcement learning for Knowledge distillation

    Jun 13, 2026Mohamed Jismy Aashik Rasool, Shabir Ahmad, Gisong Oh +1Quantization-Aware TrainingImage Restoration

  14. Signed Symmetric Quantization for Few-Bit Integers

    Jun 12, 2026Ian Colbert, Eashan Dash, Pablo Monteagudo-Lago +5LLM QuantizationWeight-Only Quantization

  15. Efficiency-Performance Trade-offs in Neural Speaker Diarization via Structured Pruning and Low-Bit Quantization

    Jun 12, 2026Rishit Chatterjee, Tahiya ChowdhuryModel CompressionSpeaker Diarization

  16. Quantum Reservoir Computing for Short-Term Power Load Forecasting in Resource-Constrained Energy Systems

    Jun 11, 2026Mansi Od, Param Pathak, Nouhaila Innan +1Time Series ForecastingReservoir Computing

  17. UniSVQ: 2-bit Unified Scalar-Vector Quantization

    Jun 9, 2026Haoyu Wang, Haiyan Zhao, Xingyu Yu +4LLM QuantizationVector Quantization

  18. Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

    Jun 8, 2026Hanyang Li, Jianhao Ma, Ying CuiQuantization-Aware TrainingNeural Network Optimization

  19. On Low-Bit Quantization Errors in Speaker Verification: Diagnostic and Mitigation

    Jun 6, 2026Hugo Leguillier, Driss Matrouf, Guillaume Lechien +1Mixed-Precision QuantizationAdaptive Inference

  20. OffQ: Taming Structured Outliers in LLM Quantization by Offsetting

    Jun 5, 2026Haoqi Wang, Lorenz K. Mueller, Jiawei Zhuang +2LLM Quantization4-Bit Quantization

  21. SPEAR: A System for Post-Quantization Error-Adaptive Recovery Enabling Efficient Low-Bit LLM Serving

    Jun 4, 2026Hongyuan Liu, Yawei Li, Zhiqiang Que +3LLM QuantizationLLM Serving

  22. Toward Multi-Domain and Long-Tailed Quantization via Feature Alignment and Scaling

    Jun 3, 2026Ting-An Chen, Chin-Yuan Yeh, De-Nian YangLong-Tail LearningLow-Bit Quantization