Embedding Compression

Momentum

4 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 32

All topics
CardsList
  1. OrBIT: Structure-Guided Embedding Compression

    Oct 7, 2026Yunied Puig, Amit Kumar JaiswalEmbedding CompressionLLM Compression

  2. Planetary Feature Fields are Scalable Earth Representations

    Sep 29, 2026Arjun Rao, Sebastian Loeschcke, Anthony Fuller +3Implicit Neural RepresentationsGeospatial Representation Learning

  3. Exact semantic readout from compressed vector representations

    Sep 16, 2026Daniel QuigleyLinear ProbingEmbedding Compression

  4. Hybrid Quantum-Classical NLP Classification with Compact Semantic Representations: An Experimental Analysis of Representation Compression

    Sep 9, 2026Ali Hassan, Zijia Zhao, Maha A. MetaweiHybrid Quantum-Classical MLText Classification

  5. Spruce: Scalable Private Outsourced Retrieval Using Compact Embeddings

    Sep 3, 2026Peichun Hua, Yunming XiaoSecure Multi-Party ComputationEmbedding Compression

  6. RSLM: Training-Free Vector Quantization for Approximate Nearest Neighbor Search

    Aug 31, 2026Rastislav Lenhardt, Teodora Dobos, Thomas Vecchiato +2Rotation-Based QuantizationVector Quantization

  7. Progressive Cramming: Reliable Token Compression and What It Reveals

    Jul 23, 2026Dmitrii Tarasov, Timofei Lashukov, Elizaveta Goncharova +1LLM CompressionEmbedding Compression

  8. TurboVec: A Case Study in Cost-Efficient Private Retrieval for Enterprise RAG via Codebook-Oblivious Quantization

    Jul 18, 2026Navnit Shukla, Kamal Pandey, Omsankar TiwariRetrieval-Augmented GenerationVector Quantization

  9. BitNet Text Embeddings

    Jun 24, 2026Zhen Li, Xin Huang, Liang Wang +8LLM QuantizationEmbedding Compression

  10. Geometric and Information Compression of Representations in Deep Learning

    Jun 19, 2026Linara Adilova, Henning Petzka, Asja Fischer +1Neural Representation GeometryEmbedding Compression

  11. Fast-TurboQuant: A Multiplier-Free Online Vector Quantization Approach

    Jun 19, 2026Pedro M. R. Pereira, Felipe A. P. de Figueiredo, Rausley A. A. de SouzaLLM QuantizationRotation-Based Quantization

  12. Lost in a Single Vector: Improving Long-Document Retrieval with Chunk Evidence Aggregation

    Jun 17, 2026Shanshan Lyu, Yiwei Wang, Yujun Cai +2Long-Context RetrievalDocument Chunking

  13. Sustainable Face Recognition on Low-Power Devices with VQ-VAE Embeddings

    Jun 13, 2026Christos Chronis, Georgios Th. Papadopoulos, Iraklis VarlamisEnergy-Efficient MLEdge Inference

  14. ColBERTSaR: Sparsified ColBERT Index via Product Quantization

    Jun 4, 2026Eugene Yang, Andrew Yates, Dawn Lawrie +3Vector QuantizationMulti-Vector Retrieval

  15. No More K-means: Single-Stage Sparse Coding for Efficient Multi-Vector Retrieval

    May 28, 2026Lixuan Guo, Yifei Wang, Tiansheng Wen +3Learned Sparse RetrievalMulti-Vector Retrieval

  16. SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation

    May 18, 2026Longtao Jiang, Jianmin Bao, Zhendong Wang +4Normalizing FlowsEmbedding Compression

  17. RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression

    May 14, 2026Zhengjia Zhong, Shuyan Ke, Zaizhou Lin +3Residual VQVector Quantization

  18. Compressed Video Aggregator: Content-driven Module for Efficient Micro-Video Recommendation

    May 9, 2026Yang Xiao, Huiyuan Chen, Kaiyuan Deng +5Video Representation LearningEmbedding Compression

  19. Benchmarking Wireless Representations: High-Dimensional vs. Compressed Embeddings for Efficiency and Robustness

    May 3, 2026Murilo Batista, Shirin Salehi, Saeed Mashdour +3Representation LearningEmbedding Compression

  20. Adaptive Transform Coding for Semantic Compression

    Apr 29, 2026Andriy Enttsel, Vincent CorlayLearned Image CompressionEmbedding Compression

  21. ADE: Adaptive Dictionary Embeddings -- Scaling Multi-Anchor Representations to Large Language Models

    Apr 27, 2026Orhan Demirci, Sezer Aptourachman, Aydın KayaText EmbeddingsWord Embeddings

  22. Beyond N-gram: Data-Aware X-GRAM Extraction for Efficient Embedding Parameter Scaling

    Apr 23, 2026Yilong Chen, Yanxi Xie, Zitian Gao +10Memory-Augmented Language ModelsLanguage Model Scaling

  23. Balanced Co-Clustering of Users and Items for Embedding Table Compression in Recommender Systems

    Apr 20, 2026Runhao Jiang, Renchi Yang, Donghao WuEmbedding CompressionRecommender Systems

  24. Modular Representation Compression: Adapting LLMs for Efficient and Effective Recommendations

    Apr 20, 2026Yunjia Xi, Menghui Zhu, Jianghao Lin +4LLM CompressionEmbedding Compression

  25. Compressing Sequences in the Latent Embedding Space: KK-Token Merging for Large Language Models

    Apr 16, 2026Zihao Xu, John Harvill, Ziwei Fan +3Token MergingLLM Compression

  26. FastE: Readout-Triggered Token Compression for LLM Embedding Inference

    Date pendingJinsong Shu, Jinyong Wen, Baokun Wang +4Token PruningLLM Inference Acceleration