Post-Training Quantization

Momentum

17 papers in the last four weeks, up 143% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 84

All topics
CardsList
  1. Beyond In-Distribution Preservation: Recovering Generalization in Quantized VLAs via Vulnerability-Oriented Tuning

    Oct 5, 2026Shen Ruan, Wenchang Gao, Jin Wang +4Post-Training QuantizationReinforcement Learning Post-Training

  2. JARQ: Joint Alternating Refinement for Quantization

    Sep 29, 2026Xinyu Wang, Sicheng Lyu, Xiao-Wen ChangPost-Training QuantizationLanguage Model Perplexity

  3. Calibrate the Decisions That Change the Future: On-Policy Post-Training Quantization for Multimodal Large Language Models

    Sep 29, 2026Wenxiao Fan, Jingling Fu, Lichen Ma +6Post-Training QuantizationPost-Training

  4. From Attention Sensitivity to Layer Role: Revisiting Mixed-Precision Quantization of Transformers

    Sep 28, 2026Nafiseh HosseinpourFardi, Negar Alihadi, Mahmoudreza Babaei +2Post-Training QuantizationMixed-Precision Quantization

  5. Beyond Reconstruction Loss in Post-Training Quantization: Balanced Fitting for Large Vision-Language Models

    Sep 28, 2026Minchan Kang, Kyeonghye Park, Seungyeon Sa +3Post-Training QuantizationRecent Vision-Language Models

  6. AERIAL: Adversarial Evaluation of Robustness in Accuracy-Preserving Low-Precision EEG Decoders

    Sep 24, 2026Saim Rehman, Muhammad ShafiqueBrain-Computer InterfaceElectroencephalography Decoding

  7. RGSQ: Riemannian Geometry-Sensitive Quantization for Large Vision-Language Models

    Sep 21, 2026Zhiping Wu, Dongdong Ren, Yangchengyu Zhou +4Large Language Model QuantizationPost-Training Quantization

  8. VLAQuantBench: Closed-Loop Evaluation of Post-Training Quantization for Vision-Language-Action Models

    Sep 21, 2026Jiuyi Xu, Qing Jin, Meida Chen +3Post-Training QuantizationClosed Loop

  9. FoldQuantVLA: Native Low-Bit Quantization of Vision-Language-Action Models via Consistent Folding

    Sep 21, 2026Hung T. Ho, Khanh D. Nguyen, Quang D. Nguyen +5Post-Training QuantizationFast Inference

  10. Global Ranks Survive, Selected Heads Shift: BOS-Sink Topology under 4-bit Weight-Only Quantization

    Sep 20, 2026Kuanlin Chen, Chen-Wei Kuo, Cheng-En OuPost-Training QuantizationMatched Fp16 Intermediate

  11. Channel-Wise and Token-Aware Post-Training Quantization for Visual State Space Duality

    Sep 15, 2026Jonghyeon Lim, Changhoon YimPost-Training QuantizationVision State Space Models

  12. Why Does Post-Training Quantization Work?

    Sep 10, 2026Yuxiang Chen, Michael Beyer, Jun Zhu +1Post-Training QuantizationQuantized

  13. SCULPT: Training Edge Vision Models for Post-Training Quantization Readiness

    Sep 1, 2026Bharadwaj Kavuri, Sourav Babu-PK, Varadhraj Ellapan +2Post-Training QuantizationGradient Clipping

  14. QTEA: Ternary LLMs with Sparse Residual Salient Weight and By-Column Optimization

    Aug 31, 2026Yipin Guo, Arun M George, Jie Fu +3Post-Training Quantization

  15. TopGQ: Fast GNN Post-Training Quantization Leveraging Topology Information

    Aug 31, 2026Dain Kwon, Kanghyun Choi, Hyeyoon Lee +4Post-Training QuantizationGraph Neural Networks

  16. Calibration Bets on the Past: Post-Training Quantization for Financial Time-Series Forecasting

    Aug 12, 2026Junyi Ye, Ivy Gateri WanjikuPost-Training QuantizationTime Series Forecasting

  17. From Sweep to Seam: Interleaved Cross-Block Post-Training Quantization

    Aug 10, 2026Achille Jacquemond, Yuma Ichikawa, Akira SakaiPost-Training Quantization

  18. Quantization Degradation in Large Language Models: A Signal-Noise Perspective

    Aug 8, 2026Chenxi Zhou, Pengfei Cao, Jinyu Ye +5Large Language Model QuantizationPost-Training Quantization

  19. PTQ4SNN: Membrane-Aware Post-Training Quantization for Spiking Neural Networks

    Aug 7, 2026Hui Xie, Tong Shi, Haotong Qin +3Spiking Neural NetworksPost-Training Quantization

  20. ReQuant: Fixed-Grid Discrete Refinement for Post-Training Quantization

    Aug 7, 2026Yongge Ma, Guoan Wang, Feiyu Wang +5Post-Training QuantizationQantis

  21. One Qubit Can Beat One Bit: Quantum Advantage for Post-Training Quantization

    Aug 5, 2026Yuma Ichikawa, Moeto MishimaQubitPost-Training Quantization

  22. Low-Dimensional High-Leverage Subspace Optimization: Beyond Full-Parameter Coupled Training for Neural Network Quantization

    Aug 4, 2026Peng Xia, Junbiao Pang, Zheng HuangPost-Training QuantizationSubspace

  23. QuantWAMs: Calibrating at the Right Granularity for World Action Models

    Jul 30, 2026Jiacheng Zhou, Jinfan Lv, Ruixuan Li +4Post-Training QuantizationWorld Models

  24. Same Predictions, Different Reasons: The Effect of Quantization on Model Explanations

    Jul 24, 2026Kazi Kamruzzaman Rabbi, Md. Zami Al Zunaed Farabe, M. Sohel RahmanPost-Training QuantizationQuantized

  25. KroQuant: Kronecker-Structured Block Transforms for Efficient Post-Training Quantization of Diffusion Transformers

    Jul 23, 2026Yann Bouquet, Alireza Khodamoradi, Kristof Denolf +1Post-Training QuantizationDiffusion Transformers

  26. Recti-Q: Feature-Space Rectification for Out-of-Distribution-Robust Quantized Perception in Edge Robotics

    Jul 20, 2026Hamidreza Yaghoubi Araghi, Parastoo Pilevar, Ming C. LinRobotic PerceptionPost-Training Quantization

  27. PolyQ: Codesigning End-to-End Quantization Framework for Scalable Edge CPU LLM Inference

    Jul 16, 2026Hyunwoo Oh, Suyeon Jang, Hanning Chen +4Post-Training Quantization

  28. Efficient Tuning Before Low-Bit Post-Training Quantization for Stochastic Gradient Descent-optimized Models

    Jul 13, 2026Peng Xia, Junbiao Pang, Muhammad Ayub SabirPost-Training QuantizationQuantized

  29. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

    Jul 9, 2026Baha Rababah, Cuneyt Gurcan Akcora, Carson K. LeungLarge Language Model QuantizationPost-Training Quantization

  30. Closing the Null Space: Guidance-Aware Quantization for Classifier-Free Diffusion

    Jul 9, 2026Abdullah Al Shafi, Sumaiya Rahim SumaClassifier-Free GuidancePost-Training Quantization

  31. KronQ: LLM Quantization via Kronecker-Factored Hessian

    Jul 8, 2026Donghyun Lee, Yuhang Li, Ruokai Yin +1Large Language Model QuantizationPost-Training Quantization

  32. FourTune: Towards Fully 4-Bit Efficient Post-Training for Diffusion Models

    Jul 7, 2026Bowen Xue, Zihan Min, Xingyang Li +8Post-Training QuantizationDiffusion Models

  33. An Empirical Study of OpenPangu Quantization on Ascend NPUs

    Jun 19, 2026Tong Shi, Jiacheng Wang, Hui Xie +4Post-Training QuantizationNeural Processing Units

  34. Mix-QVLA: Task-Evidence-Aware Mixed-Precision Quantization of Vision-Language-Action Models

    Jun 17, 2026Navin Ranjan, Andreas SavakisMixed-Precision QuantizationPost-Training Quantization

  35. TWLA: Achieving Ternary Weights and Low-Bit Activations for LLMs via Post-Training Quantization

    Jun 11, 2026Zhixiong Zhao, Zukang Xu, Zhixuan Chen +3Large Language Model QuantizationPost-Training Quantization

  36. DynamicPTQ: Mitigating Activation Quantization Collapse via Residual-Stream Dynamics

    Jun 10, 2026Zimo Zhao, Maolin Wang, Bowen Yu +3Post-Training QuantizationMixed-Precision Quantization

  37. Optimal Post-Training Quantization Scales and Where to Find Them

    Jun 9, 2026Juan Amboage, Pablo Monteagudo-Lago, Ian Colbert +2Post-Training QuantizationQuantizer

  38. Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

    Jun 8, 2026Hanyang Li, Jianhao Ma, Ying CuiQuantization-Aware TrainingPost-Training Quantization

  39. FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models

    Jun 4, 2026Haoyu Huang, Linlin Yang, Sheng Xu +5Post-Training QuantizationDiffusion Language Models

  40. STaR-Quant: State-Time Consistent Post-Training Quantization for Diffusion Large Language Models

    Jun 3, 2026Xin Yan, Aqiang Wang, Zhenglin Wan +2Large Language Model QuantizationPost-Training Quantization

  41. Massive Spikes in LLMs are Bias Vectors: Mechanistic Uncovering and Spike-Free Quantization

    Jun 1, 2026Yung-Chin Chen, Chung Peng Lee, Ze-Wei Liou +1Large Language Model QuantizationPost-Training Quantization

  42. GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation

    May 31, 2026Shihao Zhang, Rayan SaabPost-Training QuantizationLow-Rank Structure

  43. ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression

    May 30, 2026Wenya Yu, Chao Zhang, Li Wang +2Large Language Model QuantizationPost-Training Quantization

  44. HARP: Hadamard-Preconditioned Adaptive Rotation Processor for Extreme LLM Quantization

    May 28, 2026Artur Zagitov, Gleb Molodtsov, Aleksandr BeznosikovPost-Training QuantizationLarge Language Model Quantization