Activation Quantization

Latest papers 76

All topics
CardsList
  1. ViM-Q: Scalable Algorithm-Hardware Co-Design for Vision Mamba Model Inference on FPGA

    May 3, 2026Shengzhe Lyu, Yuhan She, Patrick S. Y. Hung +2Efficient Neural Network InferenceEdge Inference

  2. Colinearity Decay: Training Quantization-Friendly ViTs with Outlier Decay

    May 2, 2026Jin Tong, Guang Liang, Peilin Sun +1Vision TransformerActivation Outliers

  3. AGoQ: Activation and Gradient Quantization for Memory-Efficient Distributed Training of LLMs

    May 1, 2026Wenxiang Lin, Juntao Huang, Luhan Zhang +5LLM QuantizationCommunication-Efficient Distributed Training

  4. Technical Report: Activation Residual Hessian Quantization (ARHQ) for Low-Bit LLM Quantization

    Apr 30, 2026YiFeng Wang, Zhun Sun, Keisuke SakaguchiLLM QuantizationActivation Quantization

  5. CoQuant: Joint Weight-Activation Subspace Projection for Mixed-Precision LLMs

    Apr 29, 2026Zhe Ding, Su Pan, Duowei PanMixed-Precision QuantizationLLM Quantization

  6. LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation

    Apr 21, 2026Siqing Song, Chuang Wang, Yong Lang +2LLM QuantizationActivation Quantization

  7. AQPIM: Breaking the PIM Capacity Wall for LLMs with In-Memory Activation Quantization

    Apr 20, 2026Kosuke Matsushima, Yasuyuki Okoshi, Masato Motomura +1Compute-in-MemoryLong-Context Language Model Inference

  8. DuQuant++: Fine-grained Rotation Enhances Microscaling FP4 Quantization

    Apr 20, 2026Haokun Lin, Xinle Jia, Haobo Xu +7LLM Quantization4-Bit Quantization

  9. When W4A4 Breaks Camouflaged Object Detection: Token-Group Dual-Constraint Activation Quantization

    Apr 18, 2026Tianqi Li, Wenyu Fang, Xin He +34-Bit QuantizationActivation Quantization

  10. DyQ-VLA: Temporal-Dynamic-Aware Quantization for Embodied Vision-Language-Action Models

    Mar 9, 2026Zihao Zheng, Hangyu Cao, Chibang Tao +9VLM QuantizationEfficient VLA Model Inference

  11. Activation Quantization of Vision Encoders Needs Prefixing Registers

    Oct 6, 2025Seunghyeon Kim, Taesun Yeom, Jinho Kim +3Activation OutliersActivation Quantization

  12. GPLQ: A General, Practical, and Lightning QAT Method for Vision Transformers

    Jun 13, 2025Guang Liang, Xinyao Liu, Jianxin WuQuantization-Aware Training4-Bit Quantization

  13. FPTQuant: Function-Preserving Transforms for LLM Quantization

    Jun 5, 2025Boris van Breugel, Yelysei Bondarenko, Paul Whatmough +1LLM QuantizationLLM Inference Acceleration