World Models for Autonomous Driving

Latest papers 91

All topics
CardsList
  1. SUV: Future Scene Understanding as Video Generation for End-to-End Driving

    Aug 4, 2026Yibo Yuan, Jiacheng Fu, Jiangtong Zhu +8End-to-End Autonomous DrivingAutonomous Driving Perception

  2. RealWeather: Realistic and Scene-Faithful Weather Translation with Driving World Models

    Aug 3, 2026Yuwei Ning, Liangzhi Wang, Yi Xiao +5Synthetic-to-Real Domain AdaptationWorld Models for Autonomous Driving

  3. Auto-JEPA: A Latent World Model of Continuous Intent for End-to-End Autonomous Driving

    Jul 31, 2026Jiwei Yang, Zhengxian Chen, Chaosheng Huang +1End-to-End Autonomous DrivingJoint-Embedding Predictive Architecture

  4. HyWorldVLA: A Vision-Language-Action Model with Hybrid World Modeling for Autonomous Driving

    Jul 23, 2026Quanfu Yu, Xian Wu, Hao Xu +1World ModelsAutonomous Driving

  5. GeoWorldAD: Geometry World Action Model for Autonomous Driving

    Jul 20, 2026Songyan Zhang, Jinyuan Tian, Hanbing Li +9World Models for Autonomous DrivingMotion Planning

  6. Orbis 2: A Hierarchical World Model for Driving

    Jul 17, 2026Sudhanshu Mittal, Arian Mousakhan, Silvio Galesso +4World ModelsWorld Models for Autonomous Driving

  7. M4^\text{4}World: A Multi-view Multimodal Driving World Model for Interactive Object Manipulation and Minute-long Streaming

    Jul 15, 2026Ke Cheng, Hanqiao Ye, Lei Shi +8Multi-View Video GenerationLong-Horizon Video Generation

  8. LIDAR-AD: A Decoder-Free Latent-Interaction Dreamer with Action-Residual Chains for Autonomous Driving

    Jul 12, 2026Yongzhi Liu, Yang Xiao, Zhong Cao +5Latent Dynamics ModelingWorld Models for Autonomous Driving

  9. Is Energy Guidance All You Need? Training-Free Norm Injection for Driving World Models

    Jul 12, 2026Xiyan Su, Frank Diermeyer, Markus LienkampDiffusion Model GuidanceVideo Diffusion Models

  10. World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning

    Jul 12, 2026Tong Nie, Yuewen Mei, Junlin He +3Adversarial TrainingSelf-Play RL

  11. WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving

    Jul 9, 2026Xuerun Yan, Zhexi Lian, Nuoheng Zhang +5End-to-End Autonomous DrivingWorld Models

  12. Validate the Dream Before You Trust Its Verdict: Admissibility for World-Model Simulators

    Jul 8, 2026Christian Oefinger, Finn Rasmus Schäfer, Korbinian Moller +2World Models for Autonomous DrivingWorld Model Evaluation

  13. UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

    Jul 6, 2026Mengmeng Liu, Diankun Zhang, Jiuming Liu +7Action-Conditioned Video GenerationVideo Diffusion Models

  14. ForgeDrive: Bidirectional Cross-Conditioning for Unified Visual-Action Generation in Autonomous Driving

    Jun 30, 2026Xuchang Zhong, He Zheng, Chenxu Zhao +8Diffusion-Based PlanningWorld Models

  15. OWMDrive: Causality-Aware End-to-End Autonomous Driving via 4D Occupancy World Model

    Jun 29, 2026Junjie Cheng, Ruiqi Song, Ye Wu +3Causal World ModelsEnd-to-End Autonomous Driving

  16. CascadeOcc: Rethinking 3D Occupancy World Models with Cascaded VQ Representations

    Jun 26, 2026Kyumin Hwang, Wonhyeok Choi, Jaeyeul Kim +3World Model Learning3D Occupancy Prediction

  17. ReWorld: Learning Better Representations for World Action Models

    Jun 25, 2026Tianze Xia, Lijun Zhou, Kaixin Xiong +9Representation LearningWorld Model Learning

  18. OmniDrive: An LLM-Choreographed Multi-Agent World Model with Unified Latent Co-Compression for Multi-View Driving Video Generation

    Jun 16, 2026Zijie Meng, Yufei Liu, Chengqian Ma +8Multi-View ConsistencyMulti-View Video Generation

  19. Metis: A Generalizable and Efficient World-Action Model for Autonomous Driving and Urban Navigation

    Jun 14, 2026Jingyu Li, Zhe Liu, Dongnan Hu +10World Model LearningAutonomous Driving

  20. ReactSim-Bench: Benchmarking Reactive Behavior World Model Simulation in Autonomous Driving

    Jun 12, 2026Zhiyuan Zhang, Yanlun Peng, Jianing Zhang +7Autonomous Driving BenchmarksWorld Models for Autonomous Driving

  21. VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models

    Jun 11, 2026Ruiqi Xian, Yuehan Xian, Jing Liang +2Cross-Modal Knowledge DistillationWorld Model Learning

  22. Diffusion Transformer World-Action Model for AV Scene Prediction

    Jun 11, 2026Ruslan Sharifullin, Benjamin Jiang, Kai Xi ChewAction-Conditioned Video GenerationDiffusion Transformer

  23. PLAN-S: Bridging Planning with Latent Style Dynamics for Autonomous Driving World Models

    Jun 4, 2026Xiaoyun Qiu, Jingtao He, Yijie Chen +4Roadmap-Based Motion PlanningWorld Model-Based Planning