Motion Representation Learning

Latest papers 66

All topics
CardsList
  1. EgoLAP: Learning from Egocentric Human Data through Language-Action Reasoning

    Oct 6, 2026Lihan Zha, Shresth Grover, Tenny Yin +7Cross-Embodiment Robot LearningMotion Representation Learning

  2. Beyond Retargeting: Low-Latency and Robust Humanoid Whole-Body Teleoperation with Learned Atomic Motion Primitives

    Oct 6, 2026Xiayan Xu, Jiyu Yu, Xingzhou Chen +5Robot TeleoperationHumanoid Robot Control

  3. Kinematics-Centric Continuous Sign Language Retrieval with Gloss-Guided Boundary-Aware Alignment

    Oct 4, 2026Chang Liu, Ke Han, Davide Talon +2Cross-Modal AlignmentMotion Representation Learning

  4. World Motion Models: Flexible Sequence Modeling of SE(3) Trajectories

    Oct 1, 2026Jiahui Lei, Qianqian Wang, Trevor Darrell +1World Models for RoboticsMotion Representation Learning

  5. Magic-W0: A Structured World-Action Foundation Model for Physical Intelligence

    Sep 30, 2026Xuhua Chen, Zhenhan Yin, Yuan Zhang +15Robot Foundation ModelsAction-Conditioned World Models

  6. MotionWeave: Learning Motion-Centered Future Dynamics for Vision-Language-Action Policies

    Sep 30, 2026Jingqiu Wang, Yan WangVisuomotor Policy LearningRobotic Manipulation

  7. Video2SwimFish: An Automated Pipeline for Reconstructing Controllable Fish Models and Biological Locomotion from Real Fish Videos

    Sep 30, 2026Hangong Chen, Linfeng Cheng, Tahsin Zaman Jilan +4Underwater 3D ReconstructionRobot Locomotion

  8. Unveiling the Value of Motion for Cinematic Camera Trajectories

    Sep 30, 2026Ziqi Zhou, Yujian Yuan, Laura Sevilla-LaraCamera-Controlled Video GenerationMotion Representation Learning

  9. Eulerian Motion Reconstruction for Water Scenery

    Sep 29, 2026Chuhan Chen, Yen-Chi Cheng, Ayush Saraf +84D Reconstruction3D Reconstruction

  10. Retargeting Motions to Diverse Skeletons via Learnable Flattening

    Sep 29, 2026Kia-Jüng Yang, Fabian H. Sinz, Paweł A. PierzchlewiczZero-Shot LearningGraph Representation Learning

  11. CrossBFM: Distilling a Shared Latent Behavior Space Across Humanoid Embodiments

    Sep 29, 2026Tan-Dzung Do, Tuan Dat Phuong, Nico Bohlinger +6Robot Foundation ModelsCross-Embodiment Robot Learning

  12. Learning Expressive and Compositional Motion Representation via Spectral Skills

    Sep 29, 2026Feiyang Wu, Chenxiao Gao, Chen Yang +3Robot Skill LearningHumanoid Robot Control

  13. VidAct: Learning Manipulation from In-the-Wild Videos with Object-Centric 3D Awareness

    Sep 29, 2026Hang Li, Mingxin Zhang, Zihan Wu +9Object-Centric Representation LearningRobotic Manipulation

  14. DiMoP: Diffusion-Driven Motion Representation Learning With Frame-Level Pseudo-Classification for Skeleton-Based Action Recognition

    Sep 28, 2026Shanaka Ramesh Gunasekara, Wanqing Li, Nikalal Kaldera +2Skeleton-Based Action RecognitionMasked Diffusion Models

  15. HUMAN-TCI: Hierarchical Multi-Stream Motion-Aware Network with Torso-Centered Interaction for Text-to-Motion Retrieval

    Sep 28, 2026Muhammad Islam, Euijoon Ahn, Usman Naseem +1Cross-Modal RetrievalMotion Representation Learning

  16. TT-VidT: Decoupling the Temporal Axis for Efficient Motion-Centric Video Pretraining

    Sep 27, 2026Shih-Ying Yeh, Daniel Z. Kaplan, Xuehai Wang +3Efficient ViTsVideo Representation Learning

  17. Harnessing Coupled Stream Completion For Human-Object Interaction Modeling

    Sep 26, 2026Dawei Guan, Di Yang, Jiangtao WangHOI GenerationMotion Representation Learning

  18. MotionJEPA: Preventing Temporal Feature Collapse by Capturing Visual Changes in Latent Space

    Sep 20, 2026Markus Karmann, Shile Li, Christian Internò +10Joint-Embedding Predictive ArchitectureLatent World Models

  19. VISTA: Video-Injected Stylized Text-to-Animation

    Sep 20, 2026Monseej Purkayastha, Anindita Ghosh, Philipp SlusallekText-to-Motion GenerationHuman Motion Generation

  20. BiRoAD: Learning Shared and Role-Adaptive Representations for Bimanual Manipulation

    Sep 20, 2026Yan Shen, Yuchen Liu, Feng Jiang +5Representation LearningBimanual Robotic Manipulation

  21. MoWAM: Explicit Future Motion Prediction for Efficient World Action Models

    Sep 17, 2026Jiayu Wang, Bin Zhu, Yue Yu +1World Models for RoboticsWorld Model-Based Planning

  22. WholeBodyWAM: Learning Whole-Body World Action Models with Scalable Motion Priors

    Sep 16, 2026Bowei Zhang, Qiyao Zhang, Shuanghao Bai +8Cross-Embodiment Robot LearningWorld Action Models

  23. GeoLAM: Learning Geometry-Grounded Latent Actions from Unlabeled Human Videos

    Sep 15, 2026Yifan Xie, Hekun Tian, Jinkun Liu +3Latent Action LearningGeometric Representation Learning

  24. Learning Options for Compositional Motor Control with Adapter Banks

    Sep 15, 2026Sreejan Kumar, Marcelo Mattar, Lea DunckerRL ControlLatent Action Learning

  25. X-WBC: A Cross-Embodiment Foundation Model for Humanoid Whole-Body Control

    Sep 14, 2026Juntong Zhang, Chun Gu, Li ZhangRobot Foundation ModelsHumanoid Robot Control

  26. Atomic Motion Coordinate for Language-Steerable and Force-Responsive Manipulation

    Sep 14, 2026Jiaqi Zhai, Jingkai Zhao, Chen Yang +10Language-Conditioned Robot ManipulationForce-Controlled Robotic Manipulation

  27. UniMo: Unifying Human and Animal Motion Generation

    Sep 14, 2026Zeyu Zhang, Zhiyuan Zhang, Siheng Wang +4Text-to-Motion GenerationHuman Motion Generation

  28. PhysioAI: Clinical Knowledge-Guided Semantic Supervision for Skeleton-Based Physiotherapy Action Recognition

    Sep 14, 2026Jie Cao, Euijoon Ahn, Anwar Hassan +1Skeleton-Based Action RecognitionHuman Activity Recognition

  29. Investigating Temporal Motion Features for Pose-to-Text Indian Sign Language Translation

    Sep 14, 2026Manav Dhamecha, Praveen Kumar Chandaliya, Pruthwik MishraSign Language TranslationTransformer

  30. MoVT: Video-Augmented Motion Tokenizer for Text-to-Motion Generation

    Sep 14, 2026Beibei Jing, Tianle Guo, Youjia Zhang +5Text-to-Motion GenerationHuman Motion Generation

  31. FOCI Policy: Focus on Object-Centric Interactions for Relational Manipulation Policies

    Sep 8, 2026Ze Fu, Pinhao Song, Yutong Hu +1Generalization in Robotic ManipulationRobotic Manipulation

  32. ReMoMask-2: Latent Retrieval-Augmented Masked Motion Generation

    Sep 8, 2026Yiran Wang, Zeyu Zhang, Ling Shao +1Text-to-Motion GenerationHuman Motion Generation

  33. Puppeteer: Object-Grounded Posture-Aware Co-Speech Gesture Generation

    Aug 31, 2026Vida Adeli, Soroush Mehraban, Jacob Rommann +3Motion Diffusion ModelsHuman Motion Generation

  34. BLARM: Animating 3D Objects from Video via Blending Latent Rigid Motion Primitives

    Aug 31, 2026Pradyumn Goyal, Yizhak Ben-Shabat, Hsueh-Ti Derek Liu +6Motion Representation Learning

  35. Motion-Saliency Complementary Masked Modeling for Point Cloud Video Understanding

    Aug 31, 2026Wei Wang, Yiding Sun, Yuyan Wang +4Point Cloud LearningGenerative Modeling

  36. MASQ: Mask-Aware Spatiotemporal Quantization for Unsupervised Skeleton Action Segmentation

    Aug 30, 2026Xinyao Qin, Linxiang Peng, Youbao Ye +2Temporal Action SegmentationUnsupervised Representation Learning

  37. SignRR: Retrieve and Refine Real Motion for Sign Language Production

    Aug 28, 2026Fidel Omar Tito Cruz, Angie Sanchez Marquina, Summy Farfan +1Human Motion GenerationMotion Representation Learning

  38. Beyond Simulated Benchmarks: Evaluating Motion Representations for Fall Detection Under Real-World Data Scarcity

    Aug 13, 2026Timilehin B. Aderinola, Ilaria D'Ascanio, Luca Palmerini +5Fall DetectionRepresentation Learning

  39. MoRAE: Flow-Friendly Self-Supervised Latents for Text-to-Motion Generation

    Jul 31, 2026Yifei Zhu, Mingyi Shi, Yangyang Cai +3Self-Supervised LearningText-to-Motion Generation

  40. MUGEN: A Unified Framework for Efficient Motion Understanding and Generation

    Jul 30, 2026Zhankai Ye, Yukai Jin, Bingyang Wei +5Representation LearningHuman Motion Generation

  41. MIME: Multimodal Interactive Motion Encoder

    Jul 18, 2026Addison Zucek, Prerit Gupta, Kamila Kuatova +1Text-to-Motion GenerationCross-Modal Alignment

  42. Inertia-1: An Open Exploration of Wearable Motion Foundation Models

    Jul 7, 2026Zongzhe Xu, Aakarsh Anand, Sarah Jiang +4Human Activity RecognitionWearable Sensing

  43. Geometry-Aware Motion Latents for Learning Robust Manipulation Policies

    Jul 6, 2026Yunchao Zhang, Yijia Weng, Ruizhe Liu +3Latent Action LearningGeometric Representation Learning

  44. SAMoR: Motion Modelling for Articulated Objects of Any Skeleton and Topology

    Jul 2, 2026Yuhao Zhang, Gerard Pons-Moll, Tolga BirdalGenerative ModelingMotion Representation Learning

  45. FrameONE: Hierarchical Motion Modeling for Universal Multi-View Echocardiographic Keyframe Detection

    Jul 1, 2026Rusi Chen, Yuhao Huang, Hongyuan Zhang +4Representation LearningMulti-View Learning

  46. AnyBody: Free-Form Whole-Body Humanoid Control from Arbitrary Keypoint Guidance

    Jun 28, 2026Shuning Li, Sikai Li, Jiachen Li +1Robotic ControlHumanoid Robot Control

  47. T-MOR: Learning Motion-Aware Skeleton Representations for Human Action Recognition

    Jun 19, 2026Di Yang, Mahmoud Ali, Quan Kong +2Skeleton-Based Action RecognitionRepresentation Learning

  48. Perfect Demo Makes Poor Teacher: Learning Robust Alignment from Critical Motion Segments

    Jun 14, 2026Mingyu Liu, Zeju Li, Jiuhe Shu +4Robot Skill LearningRobotic Manipulation

  49. Decoupled Motion Representation Learning for Moving Infrared Small Target Detection

    Jun 13, 2026Guoyi Zhang, Peiwen Wu, Han Wang +2Representation LearningInfrared Small Target Detection

  50. MotionVLA: Vision-Language-Action Model for Humanoid Motion

    Jun 13, 2026Nonghai Zhang, Siyu Zhai, Yanjun Li +5Text-to-Motion GenerationHuman Motion Generation

  51. μ0μ_0: A Scalable 3D Interaction-Trace World Model

    Jun 11, 2026Seungjae Lee, Yoonkyo Jung, Jusuk Lee +6World Models for RoboticsGeneralization in Robotic Manipulation

  52. PHASOR: Phase-Anchored Universal Action Representations for Humanoid Embodiments

    Jun 1, 2026Kihyun Kim, Chaeyun Kim, Jongho Shin +4Latent Action LearningRepresentation Learning

  53. The TIME Machine: On The Power of Motion for Efficient Perception

    May 21, 2026Mantas Skackauskas, Xinyue Hao, Laura Sevilla-LaraRepresentation LearningVideo Representation Learning