Action-Conditioned Video Generation

Latest papers 74

All topics
CardsList
  1. UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

    Jul 6, 2026Mengmeng Liu, Diankun Zhang, Jiuming Liu +7Action-Conditioned Video GenerationVideo Diffusion Models

  2. MemLearner: Learning to Query Context memory for Video World Models

    Jun 30, 2026Jiwen Yu, Jianxiong Gao, Jianhong Bai +7Action-Conditioned Video GenerationLong-Horizon Video Generation

  3. Learning Transferable Dynamics Priors from Action to World Modeling

    Jun 28, 2026Ze Huang, Jiahui Zhang, Hairuo Liu +3Action-Conditioned Video GenerationRobot Policy Learning

  4. ViPSim: Collaborating Visual and Parameter Spaces for Consistent Long-Horizon Embodied World Models

    Jun 27, 2026Longyu Chen, Heng Li, Wei Yang +2Action-Conditioned Video GenerationWorld Models for Robotics

  5. Not All Actions Are Equal: Rethinking Conditioning for Dexterous World Model

    Jun 25, 2026Zizhao Yuan, Zhengtu Liang, Taowen Wang +7Action-Conditioned Video GenerationDexterous Manipulation

  6. IOI: Decoupling Kinematics and Physics for Interactive World Models

    Jun 22, 2026Chengyu Bai, Peidong Jia, Tiecheng Guo +11Action-Conditioned Video GenerationWorld Models for Robotics

  7. World Action Models: A Survey

    Jun 18, 2026Qiuhong Shen, Shihua Zhang, Yue Liao +5Action-Conditioned Video GenerationAction-Conditioned World Models

  8. SC3-Eval: Evaluating Robot Foundation Models via Self-Consistent Video Generation

    Jun 17, 2026Wei-Cheng Tseng, Gashon Hussein, Yuzhu Dong +9Action-Conditioned Video GenerationPhysical Consistency in Video Generation

  9. CausalDrive: Real-time Causal World Models for Autonomous Driving

    Jun 13, 2026Tianyi Yan, Huan Zheng, Dubing Chen +10Action-Conditioned Video GenerationAutonomous Driving

  10. Diffusion Transformer World-Action Model for AV Scene Prediction

    Jun 11, 2026Ruslan Sharifullin, Benjamin Jiang, Kai Xi ChewAction-Conditioned Video GenerationDiffusion Transformer

  11. BiWM: Advancing Open-Source Interactive Video World Models with Bidirectional Autoregression

    Jun 8, 2026Shaohao Rui, Xiaofeng Mao, Zhanyu Zhang +5Action-Conditioned Video GenerationCamera-Controlled Video Generation

  12. Echo-Memory: A Controlled Study of Memory in Action World Models

    Jun 8, 2026Wayne King, Zeyue Xue, Yuxuan Bian +13Action-Conditioned Video GenerationVideo Diffusion Models

  13. Unified Video-Action Joint Denoising for Dexterous Action and Data Generation

    Jun 2, 2026Dingrui Wang, YuAn Wang, Jinkun Liu +4Action-Conditioned Video GenerationVideo Diffusion Models

  14. Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization

    Jun 1, 2026Jingyun Liang, Min Wei, Shikai Li +5Action-Conditioned Video GenerationVideo Diffusion Models

  15. PAI-Studio: Cinematic Video Background Replacement with Camera-Aware Motion

    May 31, 2026Heyuan Gao, Bangxun Tang, Yiren Song +4Action-Conditioned Video GenerationVideo Diffusion Models

  16. Towards Interactive Video World Modeling: Frontiers, Challenges, Benchmarks, and Future Trends

    May 31, 2026Jiuming Liu, Chaojun Ni, Mengmeng Liu +7Action-Conditioned Video GenerationLong-Horizon Video Generation

  17. τ0τ_0-WM: A Unified Video-Action World Model for Robotic Manipulation

    May 31, 2026Pengfei Zhou, Shengcong Chen, Di Chen +17Action-Conditioned Video GenerationLong-Horizon Robotic Manipulation

  18. Robust Dreamer: Deviation-Aware Latent Gaussian Memory for Action-Controlled AR Video Generation

    May 29, 2026Hanlin Chen, Jiaxin Wei, Xibin Song +5Action-Conditioned Video GenerationLong-Horizon Video Generation

  19. SCOPE: Simulating Cross-game Operations in Playable Environments for FPS World Models

    May 22, 2026Zizhao Tong, Yeying Jin, Hongfeng Lai +11Action-Conditioned Video GenerationVideo Diffusion Models

  20. Aero-World: Action-Conditioned Aerial Video Generation from Inertial Controls

    May 19, 2026Abdul Mohaimen Al Radi, Kunyang Li, Yuzhang Shang +2Action-Conditioned Video GenerationAerial Robotics

  21. Nano World Models: A Minimalist Implementation of Future Video Prediction

    May 17, 2026Siqiao Huang, Partha Kaushik, Michael Chen +5Action-Conditioned Video GenerationLong-Horizon Video Generation

  22. DiLA: Disentangled Latent Action World Models

    May 15, 2026Tianqiu Zhang, Muyang Lyu, Yufan Zhang +2Action-Conditioned Video GenerationLatent Action Learning