Quantizer

Latest papers 39

All topics
CardsList
  1. XOR-Trellis: Ultra-Low-Complexity Dequantization and Curvature-Aware Hadamard-Free LLM Quantization

    Sep 30, 2026Xiaofan Que, Nir Elkayam, Spandan Pyakurel +2Large Language Model QuantizationQuantizer

  2. Exact Factorisation and Fast Computation of Invertible Constant-Q Transforms

    Sep 24, 2026Facundo Franchino, Eloi Moliner, Vesa VälimäkiFourierQuantizer

  3. Disaggregated Quantization: Specializing LLM Prefill and Decode

    Sep 22, 2026Andrei Panferov, Maximilian Kleinegger, Sweta Priyadarshi +2Large Language Model QuantizationQuantizer

  4. RGSQ: Riemannian Geometry-Sensitive Quantization for Large Vision-Language Models

    Sep 21, 2026Zhiping Wu, Dongdong Ren, Yangchengyu Zhou +4Large Language Model QuantizationPost-Training Quantization

  5. What Makes a Good Medical Image Tokenizer? Rethinking Reconstruction and Generation in Medical Image Tokenization

    Sep 21, 2026Niklas Bubeck, Yundi Zhang, Vasiliki Sideri-Lampretsa +4Medical Image GenerationVisual Tokenizers

  6. A Calibrated Instrument for Measuring How Inference Optimizations Affect Output Quality

    Sep 16, 2026Jerry KaplanLLM Inference OptimizationQuantizer

  7. KBBQ: A Predictive Noise Law and the Limits of Spectrum Flattening in FP4 Quantization

    Sep 8, 2026Lexington Whalen, Yuki Ito, Ryo SakamotoQuantizedQuantizer

  8. PACodec: A Low-bitrate Neural Speech Codec with Parallel Additive Vector Quantization

    Sep 3, 2026Fei Liu, Yang Ai, Xiao-Hang Jiang +1Neural Speech CodecsResidual Vector Quantization

  9. VibeVoice-ASR-BitNet Technical Report

    Jul 23, 2026Songchen Xu, Ting Song, Shaohan Huang +10Quantizer

  10. QuantiBias: Benchmarking Quantization-Induced Bias in LLMs

    Jul 23, 2026Emilio FerraraLarge Language Model BiasLarge Language Model Quantization

  11. Reliability Scaling Laws for Quantized Large Language Models

    Jul 12, 2026Sirine Ayadi, Sándor Daróczi, Stephan Günnemann +1Large Language Model QuantizationLarge Language Model Reliability

  12. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

    Jul 2, 2026Donghyun Lee, Jitesh Chavan, Duy Nguyen +5Diffusion TransformersQuantizer

  13. GEAR: Guided End-to-End AutoRegression for Image Synthesis

    Jun 30, 2026Bin Lin, Zheyuan Liu, Chenguo Lin +8Autoregressive Image GenerationGenerative Models

  14. Techniques for Peak Memory Reduction for LoRA Fine-tuning of LLMs on Edge Devices

    Jun 17, 2026Hassan Dbouk, Matthias Reisser, Prathamesh Mandke +2Large Language Model Fine-TuningModel Fine-Tuning

  15. Signed Symmetric Quantization for Few-Bit Integers

    Jun 12, 2026Ian Colbert, Eashan Dash, Pablo Monteagudo-Lago +5QuantizerInformation Asymmetry

  16. TWLA: Achieving Ternary Weights and Low-Bit Activations for LLMs via Post-Training Quantization

    Jun 11, 2026Zhixiong Zhao, Zukang Xu, Zhixuan Chen +3Large Language Model QuantizationPost-Training Quantization

  17. Optimal Post-Training Quantization Scales and Where to Find Them

    Jun 9, 2026Juan Amboage, Pablo Monteagudo-Lago, Ian Colbert +2Post-Training QuantizationQuantizer

  18. Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

    Jun 8, 2026Hanyang Li, Jianhao Ma, Ying CuiQuantization-Aware TrainingPost-Training Quantization

  19. LiftQuant: Continuous Bit-Width LLM via Dimensional Lifting and Projection

    Jun 2, 2026Liulu He, XuanAng Liu, Juntao Liu +8Large Language Model QuantizationQuantizer

  20. Enhancing Human-Likeness in Reinforcement Learning Agents via Hierarchical Macro Action Quantization

    May 29, 2026M. Shaheer Luqman, Usman Nizamani, Fawad Javed Fateh +4Hierarchical Reinforcement LearningOffline Reinforcement Learning

  21. Q-ARVD: Quantizing Autoregressive Video Diffusion Models

    May 20, 2026Siao Tang, Xinyin Ma, Gongfan Fang +2Autoregressive Video Diffusion ModelsQuantizer

  22. Asymmetric Generative Recommendation via Multi-Expert Projection and Multi-Faceted Hierarchical Quantization

    May 14, 2026Bin Huang, Xin Wang, Junwei Pan +6RecommendationText Embeddings

  23. WindowQuant: Mixed-Precision KV Cache Quantization based on Window-Level Similarity for VLMs Inference Optimization

    May 4, 2026Wei Tao, Xiaoyang Qu, Peiqiang Wang +4Key-Value Cache QuantizationQuantizer

  24. Quantamination: Dynamic Quantization Leaks Your Data Across the Batch

    Apr 29, 2026Hanna Foerster, Ilia Shumailov, Cheng Zhang +3QuantizerData Leakage

  25. When Flat Minima Fail: Characterizing INT4 Quantization Collapse After FP32 Convergence

    Apr 16, 2026Marcus ArmstrongPost-Training QuantizationQuantizer

  26. Attack-Dependent Robustness of Neural Audio Codecs for Adversarial ASR

    Mar 10, 2026Jordan Prescott, Thanathai Lertpetchpun, Shrikanth NarayananNeural Audio CodecsAutomatic Speech Recognition

  27. Pushing Toward the Simplex Vertices: A Simple Remedy for Code Collapse in Smoothed Vector Quantization

    Sep 26, 2025Takashi MoritaResidual Vector QuantizationQuantizer