Low-Bit Quantization

Momentum

21 papers in the last four weeks, up 62% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 155

All topics
CardsList
  1. LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection

    Jun 2, 2026Liulu He, XuanAng Liu, Juntao Liu +8LLM QuantizationLLM Compression

  2. Extreme Low-Bit Inference in Reasoning Models: Failure Modes and Targeted Recovery

    Jun 1, 2026Ekaterina Alimaskina, Darya Rudas, Denis Shveykin +3LLM QuantizationEfficient Language Model Reasoning

  3. GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation

    May 31, 2026Shihao Zhang, Rayan SaabLLM QuantizationLow-Rank Adaptation

  4. ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression

    May 30, 2026Wenya Yu, Chao Zhang, Li Wang +2LLM QuantizationPost-Training Quantization

  5. Batched Stochastic Linear Bandits with 1-Bit Communication Constraints

    May 29, 2026Ivan Lau, Daniel McMorrow, Kevin Jamieson +1Multi-Armed BanditsMinimax Regret

  6. HARP: Hadamard-Preconditioned Adaptive Rotation Processor for Extreme LLM Quantization

    May 28, 2026Artur Zagitov, Gleb Molodtsov, Aleksandr BeznosikovLLM QuantizationRotation-Based Quantization

  7. BitTP: The Lightweight Trajectory Prediction Model with BitLLM for Edge-Devices

    May 28, 2026Mincheol Kang, Hyunjin Lim, Bomin Kang +1Multi-Agent Trajectory PredictionWeight-Only Quantization

  8. Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Diffusion

    May 25, 2026Tuna Tuncer, Felix Becker, Thomas PfeilVideo Diffusion ModelsSelf-Attention

  9. GoQuant: Geometric Orthogonal Residual Projection for Multiplier-Free Power-of-Two Transformer Quantization

    May 25, 2026Maoyang Xiang, Tao Luo, Bo WangLLM QuantizationEfficient Neural Network Inference

  10. The Quantization Benefits of Residual-Free Transformers

    May 25, 2026Yiping Ji, Mahalakshmi Sabanayagam, Peyman Moghadam +2TransformerActivation Outliers

  11. InfoQuant: Shaping Activation Distributions for Low-Bit LLM Quantization

    May 25, 2026Ke Li, Dong An, Xiaoling Zang +6LLM QuantizationActivation Quantization

  12. BitsMoE: Cost-Aware Bit Allocation in Spectral Space for MoE LLM Quantization

    May 22, 2026Jiayu Zhao, Zihan Teng, Minhao Fan +4Mixed-Precision QuantizationLLM Quantization

  13. Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning

    May 22, 2026Yoshihiko Fujisawa, Yuma Ichikawa, Yudai Fujimoto +2LLM QuantizationMemory-Efficient Fine-Tuning

  14. QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks

    May 21, 2026Haotong Qin, Xudong Ma, Xianglong Liu +4Quantization-Aware TrainingLow-Bit Quantization

  15. ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models

    May 19, 2026Arash Akbari, Arman Akbari, Masih Eskandar +11Mixed-Precision QuantizationVLM Quantization

  16. Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models

    May 19, 2026Yi Zhong, Haotong Qin, Xindong Zhang +2Vision-Language ModelsVLM Quantization

  17. OScaR: The Occam's Razor for Extreme KV Cache Quantization in LLMs and Beyond

    May 19, 2026Zunhai Su, Rui Yang, Chao Zhang +11KV CachingRotation-Based Quantization

  18. K-Quantization and its Impact on Output Performance

    May 19, 2026Robin Baki Davidsson, Pierre NuguesLLM QuantizationLLM Evaluation

  19. MARR: Module-Adaptive Residual Reconstruction for Low-Bit Post-Training Quantization

    May 18, 2026Le Su, Xing Luo, Zhi JinLLM QuantizationPost-Training Quantization

  20. OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization

    May 18, 2026Zhongzhu Zhou, Donglin Zhuang, Jisen Li +4Rotation-Based QuantizationLLM Inference Acceleration

  21. WinQ: Accelerating Quantization-Aware Training of Language Models Around Saddle Points

    May 17, 2026Dongyue Li, Zechun Liu, Kai Yi +6LLM QuantizationQuantization-Aware Training

  22. When Bits Break Recourse: Counterfactual-Faithful Quantization

    May 16, 2026Chaymae Yahyati, Ismail Lamaakal, Khalid El Makkaoui +1Mixed-Precision QuantizationCounterfactual Evaluation