cs.LGOct 5, 2026

Empirical Variational Autoencoder

Authors: Kaede Shiohara

Organizations: The University of Tokyo

Abstract

We present Empirical Variational Autoencoder, a general generative framework for continuous-valued (i.e., non-vector-quantized) sequences. EVA is based on the evidence lower bound of the Variational Autoencoder (VAE) but learns autoregressive latent priors empirically from training data, which can be implemented only by an additional single linear layer on top of VAEs. By replacing the conventional standard-Gaussian constraint with the self-predicted priors, EVA significantly alleviates the latent distribution gap between prior and posterior which is typically observed in conventional VAEs, and leads to high-fidelity ancestral sampling for sequential data generation. Extensive experiments on image and sound synthesis demonstrate that EVA achieves competitive generation quality with autoregressive diffusion baselines despite its much faster inference time.

Figures & tables

Appendix figures & tables2 assets

Supplementary material from the paper’s appendix.

Appendix

Explore similar work

CardsList
  1. Entropic Auto-Encoding via Implicit Free-Energy Minimization

    May 15, 2026Hazhir Aliahmadi, Irina Babayan, Greg van AndersConditional Variational AutoencoderAutoencoder Architectures

  2. ELVAE: Evidential Learning-Based Variational Autoencoder for Uncertainty-Aware Generation

    Aug 11, 2026Ge WangEvidential Uncertainty

  3. eXact-Prior Variational Autoencoder (X-VAE): Learning Data-Adaptive Gaussian Mixture Priors for Latent Distributions

    Jun 30, 2026Qijun Chen, Shaofan LiConditional Variational AutoencoderStar-Vae