Activation Quantization

Latest papers 76

All topics
CardsList
  1. Deflating the Hessian: Rank-4 W4A4 Quantization for Multimodal Diffusion Transformers

    Oct 8, 2026Shiwen Wang, Pengxiang Zhao, Xiaoming YuanDiffusion Model QuantizationPost-Training Quantization

  2. TR-PTQ: High-Accuracy Integer-Only Transformer Post Training Quantization via Taylor Region Reformulation

    Oct 7, 2026Eliyahu Levy, Adam Teman, Yoni PugachovPost-Training QuantizationNeural Network Quantization

  3. Few Bits, One Law: Toward W2A4KV2

    Oct 6, 2026Kai Yi, Tarek Elgamal, Sruthikesh Surineni +3LLM QuantizationLow-Bit Quantization

  4. Test-Time Adaptation of Quantized ViTs via Single-Pass Quantizer-Aligned Recalibration

    Oct 6, 2026Hyeongheon Cha, Young D. Kwon, Sung-Ju LeeTest-Time AdaptationVision Transformer

  5. Joint Branch-Space Transform Coding for Diffusion Activation Quantization with Classifier-Free Guidance

    Oct 1, 2026Mingrun Jiang, Yuejia Liu, Zishan Shao +11Classifier-Free GuidanceDiffusion Model Quantization

  6. Backward-State Policy Is Part of the Learning Algorithm

    Sep 30, 2026Shuxiao Xie, Shuyang Xie, Dezhi Ran +2Mixed-Precision QuantizationBackpropagation

  7. Bits Under ZK-LLM: Evaluating Zero-Knowledge-Friendly Quantization for Verifiable Private LLM Inference

    Sep 29, 2026Taeung Yoon, Yupeng Zhang, Xiaojing LiaoLLM QuantizationLLM Inference

  8. ThinQuant: Scalable Rotation Learning for Weight and Activation Quantization of LLMs

    Sep 28, 2026Mehdi Makni, Ryan Lucas, Rahul MazumderLLM QuantizationRotation-Based Quantization

  9. TORQUE: Optimizing What (not) to Quantize Before and After Rotation

    Sep 28, 2026Ran Ben Basat, Michael Mitzenmacher, Shay VargaftikRotation-Based QuantizationVector Quantization

  10. Beyond Reconstruction Loss in Post-Training Quantization: Balanced Fitting for Large Vision-Language Models

    Sep 28, 2026Minchan Kang, Kyeonghye Park, Seungyeon Sa +3VLM QuantizationLarge Vision-Language Models

  11. JustQuant: You Don't Need Smoothing, SVD, or Rotation for 4-Bit Activation Quantization

    Sep 27, 2026Kaicheng Yang, Kaisen Yang, Chunyu Liu +8Diffusion Model QuantizationQuantization-Aware Training

  12. Q-WAM: 4-Bit Quantization of World Action Models with Action-Subspace Protection

    Sep 27, 2026Arash Akbari, Arman Akbari, Jingwu Luo +7Mixed-Precision Quantization4-Bit Quantization

  13. FoldQuantVLA: Native Low-Bit Quantization of Vision-Language-Action Models via Consistent Folding

    Sep 21, 2026Hung T. Ho, Khanh D. Nguyen, Quang D. Nguyen +5VLM QuantizationEfficient VLA Model Inference

  14. Channel-Wise and Token-Aware Post-Training Quantization for Visual State Space Duality

    Sep 15, 2026Jonghyeon Lim, Changhoon YimVisual SSMsActivation Quantization

  15. SCULPT: Training Edge Vision Models for Post-Training Quantization Readiness

    Sep 1, 2026Bharadwaj Kavuri, Sourav Babu-PK, Varadhraj Ellapan +2Edge ComputingActivation Quantization

  16. HBQ: Hierarchical Scaling Block Quantization with Hardware-Efficiency-Aware Design for Accurate LLM Inference

    Aug 31, 2026Chun-Ting Chen, Dongmin Han, Hangyeol Mun +6LLM QuantizationLLM Inference Acceleration

  17. TopGQ: Fast GNN Post-Training Quantization Leveraging Topology Information

    Aug 31, 2026Dain Kwon, Kanghyun Choi, Hyeyoon Lee +4Graph Neural NetworksActivation Quantization

  18. Calibration Bets on the Past: Post-Training Quantization for Financial Time-Series Forecasting

    Aug 12, 2026Junyi Ye, Ivy Gateri WanjikuFinancial Forecasting4-Bit Quantization

  19. KroQuant: Kronecker-Structured Block Transforms for Efficient Post-Training Quantization of Diffusion Transformers

    Jul 23, 2026Yann Bouquet, Alireza Khodamoradi, Kristof Denolf +1Diffusion TransformerDiffusion Model Quantization

  20. GaugeQuant: Online Learning of Quantization-Optimal Bases from LLM Symmetries

    Jul 22, 2026Miguel P. Bento, João F. SeabraLLM QuantizationRotation-Based Quantization

  21. Efficient Tuning Before Low-Bit Post-Training Quantization for Stochastic Gradient Descent-optimized Models

    Jul 13, 2026Peng Xia, Junbiao Pang, Muhammad Ayub SabirActivation QuantizationPost-Training Quantization

  22. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

    Jul 2, 2026Donghyun Lee, Jitesh Chavan, Duy Nguyen +5Video Diffusion ModelsDiffusion Transformer

  23. SharQ: Bridging Activation Sparsity and FP4 Quantization for LLM Inference

    Jun 25, 2026Haoqian Meng, Yilun Luo, Yafei Zhao +44-Bit QuantizationLLM Inference Acceleration