Vector-Quantized Variational Autoencoder

Latest papers 27

All topics
CardsList
  1. ProtoFlow: Prototype-Guided Flow Matching for Multivariate Time Series Forecasting

    Oct 1, 2026Shibo Feng, Wanjin Feng, Yang Qiu +3Multivariate Time Series ForecastingVector-Quantized Variational Autoencoder

  2. Scalable Discrete-to-Continuous Channel Simulation for Compression and Privacy

    Sep 14, 2026Joseph Rowan, Buu Phan, Ashish J. KhistiChannelVector-Quantized Variational Autoencoder

  3. Continuous Actions from Discrete Minds: Latent-Aligned Planning for End-to-End Autonomous Driving

    Sep 3, 2026Ruoyu Yao, Yusen Xie, Qingzhao Liu +5Autonomous DrivingLow-Latency Latent Planning

  4. Pitch Contour Tokenization using VQ-VAE and Its Application on Korean Traditional Music Analysis

    Aug 11, 2026Seonguk Ju, Seola Cho, Sooin Chung +2Audio TokenizersVector-Quantized Variational Autoencoder

  5. UniGen-AR: Unifying Visual Generation with Auto-Regressive Modeling

    Jul 27, 2026Zhipeng Bao, Zhen Zhu, Nupur Kumari +4Autoregressive Image GenerationVisual Generation

  6. VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios

    Jul 16, 2026Kailin Lyu, Long Xiao, Jianing Zeng +3TactileContact-Rich Dexterous Manipulation

  7. Differentiable Clone-Structured Causal Graphs for End-to-End Cognitive Map Learning from Image Sequences

    Jul 14, 2026Arash Nikzad, Sasan Sarbishegi, Ali Dasmeh +8Fuzzy Cognitive MapClass Activation Mapping

  8. Low-Latency Task-Oriented Image Transmission with Opportunistic Spectrum Access

    Jul 2, 2026João Henrique Inacio de Souza, Mattia Merluzzi, Mateus P. Mota +2Source-Channel CodingVector-Quantized Variational Autoencoder

  9. Integrating Facial Generation into Full-Duplex Spoken Dialogue Systems

    Jun 20, 2026Jingjing Jiang, Atsumoto Ohashi, Ryuichiro HigashinakaFull-Duplex Speech ModelsAudio-Video Generation

  10. Sustainable Face Recognition on Low-Power Devices with VQ-VAE Embeddings

    Jun 13, 2026Christos Chronis, Georgios Th. Papadopoulos, Iraklis VarlamisEdge DevicesFace Recognition Model

  11. Self-Guidance: Enhancing Neural Codecs via Decoder Manifold Alignment

    Jun 11, 2026Xiang Li, Yixuan Zhou, Jingran Xie +2Neural Speech CodecsNeural Codecs

  12. EEGDancer: Dynamic Emotion Latent Space Masked Modeling with Reinforcement Learning for EEG Continuous Emotion Prediction

    Jun 4, 2026Zhihao Zhou, Weishan Ye, Li Zhang +2Vector-Quantized Variational AutoencoderLatent Space

  13. C2GA: A Class-Controllable Generative Augmentation Framework for Respiratory Sound Classification

    Jun 1, 2026Ziqi Ma, Mengyu Han, Anteng Cai +4Respiratory Sound ClassificationConditional Variational Autoencoder

  14. Time Series as Language: A Universal Tokenizer for General-Purpose Time Series Foundation Models

    May 31, 2026Yunhao Zhang, Ruiying Qi, Jiale Zheng +3Time Series Foundation ModelsTime Series

  15. Channel-wise Vector Quantization

    May 25, 2026Wei Song, Tianhang Wang, Yitong Chen +5Autoregressive Image GenerationVisual Tokenizers

  16. BandVQ: Band-Wise Vector-Quantized EEG Foundation Model

    May 24, 2026Jamiyan Sukhbaatar, Satoshi Imamura, Toshihisa TanakaElectroencephalography Foundation ModelsElectroencephalography

  17. Distributed Image Compression with Multimodal Side Information at Extremely Low Bitrates

    May 21, 2026Guojun Xu, Mingyang Zhang, Jianwen Xiang +3Learned Image CompressionUltra-Low Bitrates

  18. Composable Crystals: Controllable Materials Discovery via Concept Learning

    May 14, 2026Nian Liu, Yuwei Zeng, Ryoji Kubo +7CrystalData-Driven Materials Discovery

  19. SimPersona: Learning Discrete Buyer Personas from Raw Clickstreams for Grounded E-Commerce Agents

    May 14, 2026Zahra Zanjani Foumani, Alberto Castelo, Shuang Xie +3Agentic CommerceUser Simulation

  20. ArcVQ-VAE: A Spherical Vector Quantization Framework with ArcCosine Additive Margin

    May 13, 2026Jaeyung Kim, YoungJoon YooVector-Quantized Variational AutoencoderResidual Vector Quantization

  21. VAnim: Rendering-Aware Sparse State Modeling for Structure-Preserving Vector Animation

    May 2, 2026Guotao Liang, Zhangcheng Wang, Chuang Wang +6Vector-Quantized Variational AutoencoderSketches

  22. REAL: Reading Out Transformer Activations for Precise Localization in Language Model Steering

    Jun 10, 2025Li-Ming Zhan, Bo Liu, Chengqiang Xie +2Linear Activation SteeringTruth