Low-Bit Quantization

Momentum

21 papers in the last four weeks, up 62% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 155

All topics
CardsList
  1. Fine-Tuning Low-Bit Models with Gradient in Quantized Code Space

    Aug 31, 2026Shiguang Wu, Zhouchen Lin, Quanming YaoFine-TuningLow-Bit Quantization

  2. RSLM: Training-Free Vector Quantization for Approximate Nearest Neighbor Search

    Aug 31, 2026Rastislav Lenhardt, Teodora Dobos, Thomas Vecchiato +2Rotation-Based QuantizationVector Quantization

  3. A Target-Centric Survey of Quantization-Aware Training

    Aug 30, 2026Jiamin Song, Mengjie Zhao, Zijing Wang +6LLM QuantizationQuantization-Aware Training

  4. Activation-Weighted Seeded Residual Coding for Low-Bit LLM Weight Repair

    Aug 24, 2026Zehao Liu, Chuangchuang Fang, Yang RenLLM QuantizationWeight-Only Quantization

  5. QUASAR: Lowering the Loss Floor of Quantization-Aware Training with Loss-Aware Reconstruction

    Aug 14, 2026Vincent Counathe, Ben Athiwaratkun, Christopher De Sa +1LLM QuantizationQuantization-Aware Training

  6. HAMP-LIC: Hessian-Aware Mixed-Precision Post-Training Quantization for Learned Image Compression

    Aug 12, 2026Yuefeng ZhangMixed-Precision QuantizationLearned Image Compression

  7. SoftWater: Class-Aware Rate Allocation for Softmax Quantization

    Aug 12, 2026Joao V. Cavalcanti, Ashia C. WilsonLLM QuantizationPost-Training Quantization

  8. From Sweep to Seam: Interleaved Cross-Block Post-Training Quantization

    Aug 10, 2026Achille Jacquemond, Yuma Ichikawa, Akira SakaiLLM QuantizationPost-Training Quantization

  9. CurveFP: Co-Designing Numerical Representation and Product Arithmetic for Language Models

    Aug 8, 2026Ye QiaoLLM QuantizationLow-Bit Quantization

  10. Which Decisions Low-Bit Quantization Breaks, and How to Predict Them

    Aug 6, 2026Zekun Wu, Swati Dhiman, Adriano KoshiyamaPost-Training QuantizationLow-Bit Quantization

  11. Low-Dimensional High-Leverage Subspace Optimization: Beyond Full-Parameter Coupled Training for Neural Network Quantization

    Aug 4, 2026Peng Xia, Junbiao Pang, Zheng HuangQuantization-Aware TrainingPost-Training Quantization

  12. Spend Bits Where Queries Look: KV Cache Vector Quantization with Attention-Preserving Transforms

    Aug 4, 2026Samuel Fernández-Menduiña, Amir Ziashahabi, Eduardo Pavez +2KV CachingVector Quantization

  13. Output-Aware Rotation for INT2 KV-Cache Quantization

    Aug 3, 2026Vincent-Daniel Yun, Woosang Lim, Minsoo Cheong +4LLM InferenceKV Caching

  14. LightRot: A Light-Weighted Rotation Scheme and Architecture for Accurate Low-Bit Large Language Model Inference

    Jul 30, 2026Sangjin Kim, Yuseon Choi, Jungjun Oh +2LLM QuantizationAI Accelerator Inference

  15. GyRot: Leveraging Hidden Synergy between Rotation and Fine-grained Group Quantization for Low-bit LLM Inference

    Jul 30, 2026Sangjin Kim, Yuseon Choi, Byeongcheol Kim +2AI Accelerator InferenceRotation-Based Quantization

  16. When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation

    Jul 25, 2026Mojtaba SoltanalianLow-Bit QuantizationNeural Network Quantization

  17. Approximate reservoir computing with a semiconductor laser for reducing energy consumption

    Jul 25, 2026Tatsuki Ito, Kazutaka Kanno, Satoshi Kawakami +1Energy-Efficient MLReservoir Computing

  18. GaugeQuant: Online Learning of Quantization-Optimal Bases from LLM Symmetries

    Jul 22, 2026Miguel P. Bento, João F. SeabraLLM QuantizationRotation-Based Quantization

  19. Contraction-Gauge Preconditioning for Quantized Matrix Multiplication

    Jul 21, 2026Piyush Sao, Narasinga Miniskar, Pedro Valero-Lara +2Post-Training QuantizationLow-Bit Quantization

  20. Efficient Tuning Before Low-Bit Post-Training Quantization for Stochastic Gradient Descent-optimized Models

    Jul 13, 2026Peng Xia, Junbiao Pang, Muhammad Ayub SabirActivation QuantizationPost-Training Quantization

  21. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

    Jul 9, 2026Baha Rababah, Cuneyt Gurcan Akcora, Carson K. LeungLLM EvaluationPost-Training Quantization