Motion Representation Learning

Latest papers 67

All topics
CardsList
  1. MorphCL: Morphological Contrastive Learning for Inertial-based Human Activity Recognition

    Oct 7, 2026Marius Bock, Yuwei Zhang, Juergen Gall +3Human Activity RecognitionMotion Representation Learning

  2. EgoLAP: Learning from Egocentric Human Data through Language-Action Reasoning

    Oct 6, 2026Lihan Zha, Shresth Grover, Tenny Yin +7Cross-Embodiment Robot LearningMotion Representation Learning

  3. Beyond Retargeting: Low-Latency and Robust Humanoid Whole-Body Teleoperation with Learned Atomic Motion Primitives

    Oct 6, 2026Xiayan Xu, Jiyu Yu, Xingzhou Chen +5Robot TeleoperationHumanoid Robot Control

  4. Kinematics-Centric Continuous Sign Language Retrieval with Gloss-Guided Boundary-Aware Alignment

    Oct 4, 2026Chang Liu, Ke Han, Davide Talon +2Cross-Modal AlignmentMotion Representation Learning

  5. World Motion Models: Flexible Sequence Modeling of SE(3) Trajectories

    Oct 1, 2026Jiahui Lei, Qianqian Wang, Trevor Darrell +1World Models for RoboticsMotion Representation Learning

  6. Magic-W0: A Structured World-Action Foundation Model for Physical Intelligence

    Sep 30, 2026Xuhua Chen, Zhenhan Yin, Yuan Zhang +15Robot Foundation ModelsAction-Conditioned World Models

  7. MotionWeave: Learning Motion-Centered Future Dynamics for Vision-Language-Action Policies

    Sep 30, 2026Jingqiu Wang, Yan WangVisuomotor Policy LearningRobotic Manipulation

  8. Video2SwimFish: An Automated Pipeline for Reconstructing Controllable Fish Models and Biological Locomotion from Real Fish Videos

    Sep 30, 2026Hangong Chen, Linfeng Cheng, Tahsin Zaman Jilan +4Underwater 3D ReconstructionRobot Locomotion

  9. Unveiling the Value of Motion for Cinematic Camera Trajectories

    Sep 30, 2026Ziqi Zhou, Yujian Yuan, Laura Sevilla-LaraCamera-Controlled Video GenerationMotion Representation Learning

  10. Eulerian Motion Reconstruction for Water Scenery

    Sep 29, 2026Chuhan Chen, Yen-Chi Cheng, Ayush Saraf +84D Reconstruction3D Reconstruction

  11. Retargeting Motions to Diverse Skeletons via Learnable Flattening

    Sep 29, 2026Kia-Jüng Yang, Fabian H. Sinz, Paweł A. PierzchlewiczZero-Shot LearningGraph Representation Learning

  12. CrossBFM: Distilling a Shared Latent Behavior Space Across Humanoid Embodiments

    Sep 29, 2026Tan-Dzung Do, Tuan Dat Phuong, Nico Bohlinger +6Robot Foundation ModelsCross-Embodiment Robot Learning

  13. Learning Expressive and Compositional Motion Representation via Spectral Skills

    Sep 29, 2026Feiyang Wu, Chenxiao Gao, Chen Yang +3Robot Skill LearningHumanoid Robot Control

  14. VidAct: Learning Manipulation from In-the-Wild Videos with Object-Centric 3D Awareness

    Sep 29, 2026Hang Li, Mingxin Zhang, Zihan Wu +9Object-Centric Representation LearningRobotic Manipulation

  15. DiMoP: Diffusion-Driven Motion Representation Learning With Frame-Level Pseudo-Classification for Skeleton-Based Action Recognition

    Sep 28, 2026Shanaka Ramesh Gunasekara, Wanqing Li, Nikalal Kaldera +2Skeleton-Based Action RecognitionMasked Diffusion Models

  16. HUMAN-TCI: Hierarchical Multi-Stream Motion-Aware Network with Torso-Centered Interaction for Text-to-Motion Retrieval

    Sep 28, 2026Muhammad Islam, Euijoon Ahn, Usman Naseem +1Cross-Modal RetrievalMotion Representation Learning

  17. TT-VidT: Decoupling the Temporal Axis for Efficient Motion-Centric Video Pretraining

    Sep 27, 2026Shih-Ying Yeh, Daniel Z. Kaplan, Xuehai Wang +3Efficient ViTsVideo Representation Learning

  18. Harnessing Coupled Stream Completion For Human-Object Interaction Modeling

    Sep 26, 2026Dawei Guan, Di Yang, Jiangtao WangHOI GenerationMotion Representation Learning

  19. MotionJEPA: Preventing Temporal Feature Collapse by Capturing Visual Changes in Latent Space

    Sep 20, 2026Markus Karmann, Shile Li, Christian Internò +10Joint-Embedding Predictive ArchitectureLatent World Models

  20. VISTA: Video-Injected Stylized Text-to-Animation

    Sep 20, 2026Monseej Purkayastha, Anindita Ghosh, Philipp SlusallekText-to-Motion GenerationHuman Motion Generation

  21. BiRoAD: Learning Shared and Role-Adaptive Representations for Bimanual Manipulation

    Sep 20, 2026Yan Shen, Yuchen Liu, Feng Jiang +5Representation LearningBimanual Robotic Manipulation

  22. MoWAM: Explicit Future Motion Prediction for Efficient World Action Models

    Sep 17, 2026Jiayu Wang, Bin Zhu, Yue Yu +1World Models for RoboticsWorld Model-Based Planning

  23. WholeBodyWAM: Learning Whole-Body World Action Models with Scalable Motion Priors

    Sep 16, 2026Bowei Zhang, Qiyao Zhang, Shuanghao Bai +8Cross-Embodiment Robot LearningWorld Action Models

  24. GeoLAM: Learning Geometry-Grounded Latent Actions from Unlabeled Human Videos

    Sep 15, 2026Yifan Xie, Hekun Tian, Jinkun Liu +3Latent Action LearningGeometric Representation Learning

  25. Learning Options for Compositional Motor Control with Adapter Banks

    Sep 15, 2026Sreejan Kumar, Marcelo Mattar, Lea DunckerRL ControlLatent Action Learning

  26. X-WBC: A Cross-Embodiment Foundation Model for Humanoid Whole-Body Control

    Sep 14, 2026Juntong Zhang, Chun Gu, Li ZhangRobot Foundation ModelsHumanoid Robot Control

  27. Atomic Motion Coordinate for Language-Steerable and Force-Responsive Manipulation

    Sep 14, 2026Jiaqi Zhai, Jingkai Zhao, Chen Yang +10Language-Conditioned Robot ManipulationForce-Controlled Robotic Manipulation

  28. UniMo: Unifying Human and Animal Motion Generation

    Sep 14, 2026Zeyu Zhang, Zhiyuan Zhang, Siheng Wang +4Text-to-Motion GenerationHuman Motion Generation

  29. PhysioAI: Clinical Knowledge-Guided Semantic Supervision for Skeleton-Based Physiotherapy Action Recognition

    Sep 14, 2026Jie Cao, Euijoon Ahn, Anwar Hassan +1Skeleton-Based Action RecognitionHuman Activity Recognition

  30. Investigating Temporal Motion Features for Pose-to-Text Indian Sign Language Translation

    Sep 14, 2026Manav Dhamecha, Praveen Kumar Chandaliya, Pruthwik MishraSign Language TranslationTransformer

  31. MoVT: Video-Augmented Motion Tokenizer for Text-to-Motion Generation

    Sep 14, 2026Beibei Jing, Tianle Guo, Youjia Zhang +5Text-to-Motion GenerationHuman Motion Generation

  32. FOCI Policy: Focus on Object-Centric Interactions for Relational Manipulation Policies

    Sep 8, 2026Ze Fu, Pinhao Song, Yutong Hu +1Generalization in Robotic ManipulationRobotic Manipulation

  33. ReMoMask-2: Latent Retrieval-Augmented Masked Motion Generation

    Sep 8, 2026Yiran Wang, Zeyu Zhang, Ling Shao +1Text-to-Motion GenerationHuman Motion Generation

  34. Puppeteer: Object-Grounded Posture-Aware Co-Speech Gesture Generation

    Aug 31, 2026Vida Adeli, Soroush Mehraban, Jacob Rommann +3Motion Diffusion ModelsHuman Motion Generation

  35. BLARM: Animating 3D Objects from Video via Blending Latent Rigid Motion Primitives

    Aug 31, 2026Pradyumn Goyal, Yizhak Ben-Shabat, Hsueh-Ti Derek Liu +6Motion Representation Learning

  36. Motion-Saliency Complementary Masked Modeling for Point Cloud Video Understanding

    Aug 31, 2026Wei Wang, Yiding Sun, Yuyan Wang +4Point Cloud LearningGenerative Modeling

  37. MASQ: Mask-Aware Spatiotemporal Quantization for Unsupervised Skeleton Action Segmentation

    Aug 30, 2026Xinyao Qin, Linxiang Peng, Youbao Ye +2Temporal Action SegmentationUnsupervised Representation Learning

  38. SignRR: Retrieve and Refine Real Motion for Sign Language Production

    Aug 28, 2026Fidel Omar Tito Cruz, Angie Sanchez Marquina, Summy Farfan +1Human Motion GenerationMotion Representation Learning

  39. Beyond Simulated Benchmarks: Evaluating Motion Representations for Fall Detection Under Real-World Data Scarcity

    Aug 13, 2026Timilehin B. Aderinola, Ilaria D'Ascanio, Luca Palmerini +5Fall DetectionRepresentation Learning

  40. MoRAE: Flow-Friendly Self-Supervised Latents for Text-to-Motion Generation

    Jul 31, 2026Yifei Zhu, Mingyi Shi, Yangyang Cai +3Self-Supervised LearningText-to-Motion Generation

  41. MUGEN: A Unified Framework for Efficient Motion Understanding and Generation

    Jul 30, 2026Zhankai Ye, Yukai Jin, Bingyang Wei +5Representation LearningHuman Motion Generation

  42. MIME: Multimodal Interactive Motion Encoder

    Jul 18, 2026Addison Zucek, Prerit Gupta, Kamila Kuatova +1Text-to-Motion GenerationCross-Modal Alignment

  43. Inertia-1: An Open Exploration of Wearable Motion Foundation Models

    Jul 7, 2026Zongzhe Xu, Aakarsh Anand, Sarah Jiang +4Human Activity RecognitionWearable Sensing

  44. Geometry-Aware Motion Latents for Learning Robust Manipulation Policies

    Jul 6, 2026Yunchao Zhang, Yijia Weng, Ruizhe Liu +3Latent Action LearningGeometric Representation Learning

  45. SAMoR: Motion Modelling for Articulated Objects of Any Skeleton and Topology

    Jul 2, 2026Yuhao Zhang, Gerard Pons-Moll, Tolga BirdalGenerative ModelingMotion Representation Learning

  46. FrameONE: Hierarchical Motion Modeling for Universal Multi-View Echocardiographic Keyframe Detection

    Jul 1, 2026Rusi Chen, Yuhao Huang, Hongyuan Zhang +4Representation LearningMulti-View Learning

  47. AnyBody: Free-Form Whole-Body Humanoid Control from Arbitrary Keypoint Guidance

    Jun 28, 2026Shuning Li, Sikai Li, Jiachen Li +1Robotic ControlHumanoid Robot Control

  48. T-MOR: Learning Motion-Aware Skeleton Representations for Human Action Recognition

    Jun 19, 2026Di Yang, Mahmoud Ali, Quan Kong +2Skeleton-Based Action RecognitionRepresentation Learning

  49. Perfect Demo Makes Poor Teacher: Learning Robust Alignment from Critical Motion Segments

    Jun 14, 2026Mingyu Liu, Zeju Li, Jiuhe Shu +4Robot Skill LearningRobotic Manipulation

  50. Decoupled Motion Representation Learning for Moving Infrared Small Target Detection

    Jun 13, 2026Guoyi Zhang, Peiwen Wu, Han Wang +2Representation LearningInfrared Small Target Detection

  51. MotionVLA: Vision-Language-Action Model for Humanoid Motion

    Jun 13, 2026Nonghai Zhang, Siyu Zhai, Yanjun Li +5Text-to-Motion GenerationHuman Motion Generation

  52. μ0μ_0: A Scalable 3D Interaction-Trace World Model

    Jun 11, 2026Seungjae Lee, Yoonkyo Jung, Jusuk Lee +6World Models for RoboticsGeneralization in Robotic Manipulation

  53. PHASOR: Phase-Anchored Universal Action Representations for Humanoid Embodiments

    Jun 1, 2026Kihyun Kim, Chaeyun Kim, Jongho Shin +4Latent Action LearningRepresentation Learning