Vector Quantization

Also known as VQ

Momentum

8 papers in the last four weeks, level with the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 86

All topics
CardsList
  1. Critic-Driven Voronoi-Quantization for Distilling Deep RL Policies to Explainable Models

    May 14, 2026Senne Deproost, Denis Steckelmacher, Ann NowéReinforcement LearningVector Quantization

  2. Asymmetric Generative Recommendation via Multi-Expert Projection and Multi-Faceted Hierarchical Quantization

    May 14, 2026Bin Huang, Xin Wang, Junwei Pan +6Vector QuantizationRecommender Systems

  3. RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression

    May 14, 2026Zhengjia Zhong, Shuyan Ke, Zaizhou Lin +3Residual VQVector Quantization

  4. ArcVQ-VAE: A Spherical Vector Quantization Framework with ArcCosine Additive Margin

    May 13, 2026Jaeyung Kim, YoungJoon YooVariational AutoencodersImage Generation

  5. Fitting Multilinear Polynomials for Logic Gate Networks

    May 9, 2026Youngsung KimBoolean Function LearningNeural Network Optimization

  6. Taming the Entropy Cliff: Variable Codebook Size Quantization for Autoregressive Visual Generation

    May 7, 2026Bowen Zheng, Weijian Luo, Guang Yang +2Visual Autoregressive ModelsVector Quantization

  7. Quantizing With Randomized Hadamard Transforms: Efficient Heuristic Now Proven

    May 7, 2026Ran Ben-Basat, William Kuszmaul, Michael Mitzenmacher +2Rotation-Based QuantizationGradient Compression

  8. Efficient Multivector Retrieval with Token-Aware Clustering and Hierarchical Indexing

    Apr 30, 2026Silvio Martinico, Franco Maria Nardini, Cosimo Rulli +1ClusteringVector Quantization

  9. FASQ: Flexible Accelerated Subspace Quantization for Calibration-Free LLM Compression

    Apr 22, 2026Ye Qiao, Yian Wang, Zhiheng Chen +2LLM CompressionGPU Acceleration

  10. Revisiting RaBitQ and TurboQuant: A Symmetric Comparison of Methods, Theory, and Experiments

    Apr 21, 2026Jianyang Gao, Yutong Gou, Yuexuan Xu +5Vector QuantizationKV-Cache Quantization

  11. A Note on TurboQuant and the Earlier DRIVE/EDEN Line of Work

    Apr 20, 2026Ran Ben-Basat, Yaniv Ben-Itzhak, Gal Mendelson +3Residual VQVector Quantization

  12. AQPIM: Breaking the PIM Capacity Wall for LLMs with In-Memory Activation Quantization

    Apr 20, 2026Kosuke Matsushima, Yasuyuki Okoshi, Masato Motomura +1Compute-in-MemoryLong-Context Language Model Inference

  13. A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics

    Apr 16, 2026Fawad Javed Fateh, Ali Shah Ali, Murad Popattia +4ICL for RoboticsVector Quantization

  14. Leech Lattice Vector Quantization for Efficient LLM Compression

    Mar 11, 2026Tycho F. A. van der Ouderaa, Mart van Baalen, Paul Whatmough +1LLM QuantizationLLM Compression

  15. LGQ: Learnable Geometric Quantization for Image Tokenization

    Feb 17, 2026Idil Bilge Altun, Mert Onur Cakiroglu, Elham Buxton +2Image TokenizationVector Quantization

  16. Pushing Toward the Simplex Vertices: A Simple Remedy for Code Collapse in Smoothed Vector Quantization

    Sep 26, 2025Takashi MoritaLearned Image CompressionVector Quantization

  17. Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey

    Jul 21, 2025Jindong Li, Yali Fu, Jiahong Liu +5Multimodal Large Language ModelsVector Quantization

  18. LC-QAT: Data-Efficient 2-Bit QAT for LLMs via Linear-Constrained Vector Quantization

    Date pendingHaoyu Wang, Xingyu Yu, Haiyan Zhao +2LLM QuantizationQuantization-Aware Training