Discrete Action Tokenizers

Momentum

5 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 22

All topics
CardsList
  1. Token Communication-Assisted Collaborative Embodied Artificial Intelligence: Concepts, Framework, and Opportunities

    Oct 1, 2026Peng Yi, Ying-Chang LiangEmbodied Artificial IntelligenceSemantic Communications

  2. Rethinking Causal Action Tokenization with Conditional Annealing in Flow Matching

    Sep 28, 2026Chenyu Zhang, Yuhang Cao, Daru Du +8Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  3. Direction-Scale Decomposition in Action Representation: Rethinking What to Tokenize for Vision-Language-Action Models

    Sep 24, 2026Yufei Duan, Hang Yin, Alberta Longhini +2Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  4. Beyond Reconstruction Error: Analytical and Data-Driven Action Tokenization for Autoregressive Vision-Language-Action Models

    Sep 22, 2026Yuxin Yang, Gaohan He, Changxue Guan +1Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  5. Don't Mask the Environment: Observation Supervision Changes How Agents Explore Under RL

    Sep 17, 2026Juzheng Zhang, Disha Makhija, Manoj Ghuhan Arivazhagan +2Supervised FinetuningDiscrete Action Tokenizers

  6. ActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models

    Sep 16, 2026Shijie Lian, Bin Yu, Zhaolong Shen +5Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  7. M2Tok: Multi-head Multi-codebook Discrete Action Tokenization for Vision-Language-Action Models

    Sep 16, 2026Chunpu Xu, Zhixuan Liang, Yuhao Zhang +6Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  8. WorldToken: Time-First Sequence Modeling for Robotic Imitation Learning

    Aug 23, 2026Chunkai Yang, Andong Yang, Di Huang +2Discrete Action TokenizersEfficient World-Action Model

  9. Ordered Action Tokens for Visuomotor Policy Learning

    Jul 23, 2026Chaoqi Liu, Yue Zhao, Haonan Chen +4Discrete Action TokenizersVisuomotor Policy

  10. SA-VLA: State-aware tokenizer for improving Vision-Language-Action Models' performance

    Jun 29, 2026Tengyue Jiang, Chunpu Xu, Jiayue Kang +1Discrete Action TokenizersGeneralizable Vision-Language-Action Policies

  11. NAC: Neural Action Codec for Vision-Language-Action Models

    Jun 19, 2026Ahad Jawaid, Yu XiangDiscrete Action TokenizersNeural Codecs

  12. RepWAM: World Action Modeling with Representation Visual-Action Tokenizers

    Jun 11, 2026Junke Wang, Qihang Zhang, Shuai Yang +5Efficient World-Action ModelDiscrete Action Tokenizers

  13. X-Tokenizer: A Multimodal Action Tokenizer for Vision-Language-Action Pretraining

    Jun 7, 2026Miracle Kang, Lights Shi, Lucy Liang +10Discrete Action TokenizersDiffusion-Based Vision-Language-Actions

  14. Coarse-to-Control: Action-Token Planning for Vision-Language-Action Models

    Jun 5, 2026Jinhao Wu, Shiduo Zhang, Yicheng Liu +9Discrete Action TokenizersClassical Planning

  15. LAST: Bridging Vision-Language and Action Manifolds via Gromov-Wasserstein Alignment

    May 27, 2026Huaihai Lyu, Chaofan Chen, Yuheng Ji +4Recent Vision-Language ModelsDiscrete Action Tokenizers

  16. UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling

    Apr 21, 2026Boyu Chen, Yi Chen, Lu Qiu +3Cross-Embodiment TransferHuman-To-Robot Transfer

  17. EAST: Early Action Prediction Sampling Strategy with Token Masking

    Apr 20, 2026Iva Sović, Ivan Martinović, Marin OršićAction PredictionDiscrete Action Tokenizers

  18. A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics

    Apr 16, 2026Fawad Javed Fateh, Ali Shah Ali, Murad Popattia +4Discrete Action TokenizersImitation Learning