Visual Tokenization

Momentum

2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 44

All topics
CardsList
  1. A More Word-like Image Tokenization for MLLMs

    May 18, 2026Hyun Lee, Hyemin Jeong, Yejin Kim +4Image TokenizationEfficient VLM Inference

  2. Beyond the Last Layer: Multi-Layer Representation Fusion for Visual Tokenization

    May 11, 2026Xuanyu Zhu, Yan Bai, Yang Shi +4AutoencodersVisual Tokenization

  3. Fre-Res: Frequency-Residual Video Token Compression for Efficient Video MLLMs

    May 10, 2026Yigui Feng, Qinglin Wang, Yang Liu +1Efficient VLM InferenceVisual Tokenization

  4. Learning Discrete Autoregressive Priors with Wasserstein Gradient Flow

    May 7, 2026Bowen Zheng, Yihong Luo, Tianyang HuImage TokenizationVisual Tokenization

  5. MUSE: Resolving Manifold Misalignment in Visual Tokenization via Topological Orthogonality

    May 7, 2026Panqi Yang, Haodong Jing, Jiahao Chao +5Visual Representation LearningImage Tokenization

  6. Visual Text Compression as Measure Transport

    May 6, 2026Lv Tang, Tianyi Zheng, Yang Liu +2Efficient VLM InferenceVisual Tokenization

  7. ViTok-v2: Scaling Native Resolution Auto-Encoders to 5 Billion Parameters

    May 6, 2026Philippe Hansen-Estruch, Jiahui Chen, Vivek Ramanujan +9Image TokenizationAutoencoders

  8. End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer

    May 1, 2026Wenda Chu, Bingliang Zhang, Jiaqi Han +4Image TokenizationVisual Tokenization

  9. VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations

    Apr 27, 2026Maitreya Patel, Jingtao Li, Weiming Zhuang +2Image TokenizationVisual Tokenization

  10. COMiT: Learning Structured Visual Tokens through Sequential Communication

    Feb 24, 2026Aram Davtyan, Yusuf Sahin, Yasaman Haghighi +4Image TokenizationVisual Tokenization

  11. Spiking Patches: Asynchronous, Sparse, and Efficient Tokens for Event Cameras

    Oct 30, 2025Christoffer Koo Øhrstrøm, Ronja Güldenring, Lazaros NalpantidisEvent-Based VisionVisual Tokenization

  12. Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs

    Date pendingGuiqiu Liao, Matjaz Jogan, Daniel A. HashimotoImage TokenizationHealthcare