World

Momentum

28 papers in the last four weeks, up 22% on the four weeks before. 0.3% of all new papers.

Jul 6Week of Sep 21

Latest papers 192

All topics
CardsList
  1. MemWM: Memory-Augmented Text-Based World Model

    Aug 7, 2026Yujun Wang, Tao Zhang, Jinhe Bi +9World ModelsNext-State Prediction

  2. Is Forward Prediction Enough? Physical State Grounding for JEPA World Models

    Aug 7, 2026Haodong Yan, Jiaguan Zhu, Mingyuan Jia +12Latent World ModelsWorld Models

  3. Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection

    Aug 7, 2026Jiazhuo Li, Yiming Fei, Zhiruo Zhou +1World ModelsLatent Dynamics

  4. To See a World in a Living Context: Unified Indoor-Outdoor Urban World Generation

    Aug 6, 2026Xiaobin Huang, Zilong Huang, Yang Luo +3Playable Video World GenerationIndoor Environments

  5. Vorch-Director: Interactive World Story Model via Noise-Aware Error Rectification

    Aug 6, 2026Lisai Zhang, Yidi Wu, Qi Liu +7Audio-Video GenerationDramadirector

  6. Overcoming Statistical Bias in Action-Controllable World Models

    Aug 5, 2026Yuhong Shi, Zhenhao Chu, Jie Wei +3Efficient World-Action ModelAction Prediction

  7. Quo Vadis, World Modeling?

    Aug 3, 2026Yu Yang, Xuemeng Yang, Licheng Wen +17World ModelsWorld

  8. WorldExam: Benchmarking World Models from Apparent Appearance to Inherent Reactivity

    Aug 3, 2026Yuxue Yang, Shuyao Shang, Jiahe Wang +13Video World ModelsWorld Models

  9. WorldDynCache: Risk-Controlled Latent Dynamics Approximation for Diffusion World Model

    Aug 3, 2026Leyang Chen, Junyi Wu, Shaoqiu Zhang +1Latent World ModelsLatent Dynamics

  10. Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

    Aug 1, 2026Masaki Yoshida, Ren Togo, Takahiro Ogawa +1Spatial Audio3D Gaussian

  11. Mental World Modeling

    Jul 29, 2026Hao Fei, Yiran ZhaoWorld ModelsWorld

  12. CG-World: A Large-Scale World-State Dataset and Protocol for World Models

    Jul 29, 2026Yiming Cai, Fangjie Yu, Meiqing Yu +3Video World ModelsWorld Models

  13. VisualPatchWorld: Code World Models as Latent Structured Representations for Planning

    Jul 28, 2026Jiaxin Bai, Jiaxuan XiongWorld ModelsWorld

  14. LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments

    Jul 27, 2026Pei Liu, Nan Zheng, Lang Zhang +8Efficient World-Action ModelScalable Robot Learning

  15. Action-Conditioned World Model for Goal Plane Probe Guidance in Robotic Ultrasound

    Jul 24, 2026Siqi Fan, Mingcong Chen, Ran Liu +5Robotic UltrasoundEfficient World-Action Model

  16. KineBench: Benchmarking Embodied World Models via IDM-Free Kinematic Grounding

    Jul 22, 2026Zeyu Liu, Zhangzhe Zhu, Yang Zhang +3Articulated KinematicsWorld Models

  17. AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report

    Jul 20, 2026AlayaWorld Team, Kaipeng Zhang, Chuanhao Li +15Video World ModelsWorld

  18. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangModel-Based Reinforcement LearningProbabilistic Safety

  19. DriftWorld: Fast World Modeling through Drifting

    Jul 16, 2026Susie Lu, Haonan Chen, Weirui Ye +1Efficient World-Action ModelWorld Models

  20. Video = World + Event Stream

    Jul 16, 2026Lianghua Huang, Zhi-Fan Wu, Yupeng Shi +24StreamingMultimodal Understanding

  21. ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space

    Jul 13, 2026Mingchao Sun, Luyang Tang, Yu Liu +343D WorldWorld

  22. Stateful Worlds, Stateless Elasticity: Exact-State Serving for Interactive World Models

    Jul 11, 2026Jin Li, Jiawei ChenPersistent StateWorld Models

  23. A Control Theory of Predictability in Latent World Models

    Jul 11, 2026Hanzhe You, Yonggang Zhang, Maohao Ran +6Latent World ModelsPrediction Error

  24. MentalThink: Shaping Thoughts in Mental SVG World

    Jul 3, 2026Kangheng Lin, Jisheng Yin, Dingming Li +11ThinkImagination

  25. WorldSample: Closed-loop Real-robot RL with World Modelling

    Jul 2, 2026Yuquan Xue, Le Xu, Zeyi Liu +5Scalable Robot LearningEfficient World-Action Model

  26. World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments

    Jul 1, 2026Ananya Mantravadi, Harshit Rajgarhia, Prasanna Desikan +1Icr-RlMemoryagentbench

  27. World from Motion: Generative Dynamic Gaussian Reconstruction from Monocular Video

    Jul 1, 2026Liyuan Zhu, Shengyu Huang, Amrita Mazumdar +6Monocular Video4D Reconstruction

  28. AdaJEPA: An Adaptive Latent World Model

    Jun 30, 2026Ying Wang, Oumayma Bounou, Yann LeCun +1Latent World ModelsModel Predictive Control

  29. Orca: The World is in Your Mind

    Jun 29, 2026Yihao Wang, Yuheng Ji, Mingyu Cao +54Latent World ModelsAction Prediction

  30. OWMDrive: Causality-Aware End-to-End Autonomous Driving via 4D Occupancy World Model

    Jun 29, 2026Junjie Cheng, Ruiqi Song, Ye Wu +3Causality-Aware End-To-End Autonomous DrivingDrives

  31. Cognitive World Models for Process-Level Social Influence Evaluation

    Jun 28, 2026Minghui Ma, Bin Guo, Han Wang +4Social InfluenceCognitive Science

  32. J-LAW: Joint Localization and Action-Conditioned World Modeling via Coupled Latent Factor Graphs

    Jun 27, 2026Guanqun Cao, Liang ChenLatent World ModelsLow-Latency Latent Planning

  33. When Multi-Robot Systems Meet Agentic AI:Towards Embodied Collective Intelligence

    Jun 26, 2026Yuxuan Yan, Yuanyuan Jia, Qianqian YangMulti-Robot SystemsModel-Based Multi-Agent Systems

  34. Scene and Human in One World: Reconstruction in a Feedforward Pass

    Jun 26, 2026Boao Shi, Qiao Feng, Yiming Huang +1Human Mesh RecoveryMonocular Video

  35. MemoBench: Benchmarking World Modeling in Dynamically Changing Environments

    Jun 25, 2026Haoyu Chen, Kaichen Zhou, Hang Hua +11Long-Video BenchmarksGenerative Video Models

  36. In-Context World Modeling for Robotic Control

    Jun 24, 2026Siyin Wang, Junhao Shi, Senyu Fei +4Efficient World-Action ModelScalable Robot Learning

  37. Trimming the Long-Tail of Visual World Modeling Evaluation

    Jun 23, 2026Bingxuan Li, Yining Hong, Cheng Qian +6Video World ModelsWorld

  38. IOI: Decoupling Kinematics and Physics for Interactive World Models

    Jun 22, 2026Chengyu Bai, Peidong Jia, Tiecheng Guo +11Video World ModelsInverse Dynamics

  39. Beyond Hooking Onto the World: Referential Profiles and the Numerical Structure of LLM Grounding

    Jun 19, 2026Joo Yull RheeContextual GroundingStance

  40. Inverting the Bellman Equation: From QQ-Values to World Models

    Jun 19, 2026Alistair Letcher, Mattie Fellows, Alexander D. Goldie +3Model-Free Reinforcement LearningGoal-Conditioned Reinforcement Learning

  41. MV-WAM: Manifold-Aware World Action Model with Value Augmentation

    Jun 19, 2026Jintao Chen, Peidong Jia, Qingpo Wuwu +13Efficient World-Action ModelFaster-Wam

  42. MemoryWAM: Efficient World Action Modeling with Persistent Memory

    Jun 18, 2026Sizhe Yang, Juncheng Mu, Tianming Wei +8Efficient World-Action ModelWorld Models

  43. World Action Models: A Survey

    Jun 18, 2026Qiuhong Shen, Shihua Zhang, Yue Liao +5Recent World-Action ModelsWorld Models

  44. Sensorimotor World Models: Perception for Action via Inverse Dynamics

    Jun 18, 2026Petr Ivashkov, Randall Balestriero, Bernhard SchölkopfLatent World ModelsInverse Dynamics

  45. DREAM-Chunk: Reactive Action Chunking with Latent World Model

    Jun 17, 2026Wenxi Chen, Kaidi Zhang, Chi Lin +6Action ChunksLatent World Models

  46. Looped World Models

    Jun 16, 2026Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang +28World ModelsLong-Horizon Inference

  47. Closing the Feedback Loop: From Experience Extraction to Insight Governance in Verbal Reinforcement Learning

    Jun 16, 2026Yanwei Cui, Xing Zhang, Yulong Zhang +4Feedback LoopOffline Reinforcement Learning

  48. AI Pluralism and the Worlds It Misses

    Jun 15, 2026Rashid MushkaniInternal PluralismArtificial Intelligence Governance

  49. How Should World Models Be Evaluated for Embodied Decision-Making? A Decision-Making-Centric Position

    Jun 13, 2026Yang Yu, Shiyuan Zhang, Yifei Sheng +2World ModelsEmbodied Artificial Intelligence

  50. VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models

    Jun 11, 2026Ruiqi Xian, Yuehan Xian, Jing Liang +23D Semantic Occupancy PredictionSemantic Geometry

  51. MoVerse: Real-Time Video World Modeling with Panoramic Gaussian Scaffold

    Jun 11, 2026Yang Zhou, Ziheng Wang, Yuqin Lu +4Video World ModelsOmnidirectional Images