Quantization-Aware Training

Momentum

5 papers in the last four weeks, up 67% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 41

All topics
CardsList
  1. Q-MINO: A Minimal-Norm Method for Quantization-Aware Training

    Sep 30, 2026Don LiQuantization-Aware TrainingFlat Minima

  2. QATFactory: A Versatile, Deployment-Aligned Framework for Quantization-aware Training and Distillation of LLMs

    Sep 30, 2026Weili Xu, Jisen Li, Yuqing Jian +8Large Language Model QuantizationQuantization-Aware Training

  3. P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

    Sep 28, 2026Haizhao Jing, Zhenhao Shang, Haokui Zhang +2Visual Token PruningLarge Language Model Quantization

  4. JustQuant: You Don't Need Smoothing, SVD, or Rotation for 4-Bit Activation Quantization

    Sep 27, 2026Kaicheng Yang, Kaisen Yang, Chunyu Liu +8Quantization-Aware TrainingInference Cost

  5. FairCompressAgent: An Agentic Framework for Fairness-Aware Model Compression for FPGA Deployment

    Sep 15, 2026Yuanbo Guo, Yiyu ShiCompressed ModelQuantization-Aware Training

  6. Quantum-Inspired Trainable and Parameter-Efficient Tensor Networks for Image Inpainting

    Sep 15, 2026Shiwen An, Konstantinos SlavakisTensor NetworksQuantization-Aware Training

  7. A Target-Centric Survey of Quantization-Aware Training

    Aug 30, 2026Jiamin Song, Mengjie Zhao, Zijing Wang +6Quantization-Aware TrainingSurvey

  8. FQTree: Fine-grained Quantization and Hardware Generation of Boosted Decision Trees

    Aug 12, 2026Zhiqiang Que, Chang Sun, Haiyang Wang +6Quantization-Aware TrainingField-Programmable Gate Arrays

  9. Quantization Inflates Reasoning: Token Inflation as a Hidden Cost of Low-Bit Reasoning Models

    Jun 24, 2026Xinyu Lian, Walid Krichene, Beichen Huang +4Large Language Model QuantizationQuantization-Aware Training

  10. SwitchBraidNet: Quantisation-Aware Lightweight Architecture for Hybrid Brain-Computer Interface

    Jun 17, 2026Gourav Siddhad, Yogesh Kumar MeenaBrain-Computer InterfaceElectroencephalography

  11. Ternary Mamba: Grouped Quantization-Aware Training of W1.58A16 State Space Models

    Jun 16, 2026Ramprasath Ganesaraja, Sahil Dilip Panse, Swathika NQuantization-Aware TrainingState Space Models

  12. ReQAT: Achieving Full-Precision Reasoning Accuracy with 4-bit Floating-Point Quantization-Aware Training

    Jun 14, 2026Janghwan Lee, Sihwa Lee, Jinseok Kim +4Quantization-Aware TrainingFp8

  13. SPARK: Spatial Policy-driven Adaptive Reinforcement learning for Knowledge distillation

    Jun 13, 2026Mohamed Jismy Aashik Rasool, Shabir Ahmad, Gisong Oh +1Quantization-Aware TrainingKnowledge Distillation

  14. Trainability of IQP Quantum Circuit Born Machines Under Gaussian Initialization

    Jun 8, 2026Gennaro De Luca, Vinayak Sharma, Aviral ShrivastavaQuantum Machine LearningQuantum Circuits

  15. Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

    Jun 8, 2026Hanyang Li, Jianhao Ma, Ying CuiQuantization-Aware TrainingPost-Training Quantization

  16. On Low-Bit Quantization Errors in Speaker Verification: Diagnostic and Mitigation

    Jun 6, 2026Hugo Leguillier, Driss Matrouf, Guillaume Lechien +1Automatic Speaker VerificationQuantization-Aware Training

  17. Scale When Needed: Adaptive Neuron-level Mixed Precision Quantization Aware Training

    May 24, 2026Ayush K. Varshney, Konstantinos Vandikas, Šarūnas Girdzijauskas +2Mixed-Precision QuantizationQuantization-Aware Training

  18. Quantized Machine Learning Models for Medical Imaging in Low-Resource Healthcare Settings

    May 19, 2026Sumanth Meenan Kanneti, Aryan ShahQuantization-Aware TrainingMobilenetv2

  19. Saliency-Aware Regularized Quantization Calibration for Large Language Models

    May 7, 2026Yanlong Zhao, Xiaoyuan Cheng, Huihang Liu +6Large Language Model QuantizationPost-Training Quantization

  20. Bridging the Training-Deployment Gap: Gated Encoding and Multi-Scale Refinement for Efficient Quantization-Aware Image Enhancement

    Apr 23, 2026Dat To-Thanh, Nghia Nguyen-Trong, Hoang Vo +2Quantization-Aware TrainingMobilenetv2

  21. Efficient INT8 Single-Image Super-Resolution via Deployment-Aware Quantization and Teacher-Guided Training

    Apr 22, 2026Pham Phuong Nam Nguyen, Nam Tien Le, Thi Kim Trang Vo +1Quantization-Aware TrainingUpsampling

  22. Are Large Language Models Economically Viable for Industry Deployment?

    Apr 21, 2026Abdullah Mohammad, Sushant Kumar Ray, Pushkar Arora +5Rate ScalingQuantization-Aware Training

  23. Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs

    Jan 30, 2026Yanlong Chen, Amirhossein Habibian, Luca Benini +1Recent Vision-Language ModelsQuantization-Aware Training

  24. QuantKAN: A Unified Quantization Framework for Kolmogorov Arnold Networks

    Nov 24, 2025Kazi Ahmed Asif Fuad, Lizhong ChenQuantization-Aware TrainingKolmogorov-Arnold Networks

  25. SalQ-VLM: Fine-Grained Saliency-Guided Quantization for Vision-Language Models

    Aug 5, 2025Yufei Xue, Yushi Huang, Lunjie Zhu +2Recent Vision-Language ModelsQuantization-Aware Training

  26. GPLQ: A General, Practical, and Lightning QAT Method for Vision Transformers

    Jun 13, 2025Guang Liang, Xinyao Liu, Jianxin WuQuantization-Aware TrainingSelf-Supervised Vision Transformers

  27. LC-QAT: Data-Efficient 2-Bit QAT for LLMs via Linear-Constrained Vector Quantization

    Date pendingHaoyu Wang, Xingyu Yu, Haiyan Zhao +2Large Language Model QuantizationQuantization-Aware Training