Robot Manipulation Benchmarks

Latest papers 200

All topics
CardsList
  1. GraspIT: A Dataset Bridging the Sim-to-Real gap and back for Validated Grasping SE(3) Pose Generation

    Jul 7, 2026Paul Koch. Adem Karakurt, André SersRobotic GraspingRobotic Data Collection

  2. SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects

    Jul 5, 2026Bowen Jing, Mingxin Wang, Ruiyang Hao +15Tactile SensingRobotics Simulation

  3. GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation

    Jul 2, 2026GigaWorld Team, Angyuan Ma, Boyuan Wang +24Robot Foundation ModelsAction-Conditioned World Models

  4. PhysMani: Physics-principled 3D World Model for Dynamic Object Manipulation

    Jul 2, 2026Peng Yun, Shouwang Huang, Hao Li +3World Models for RoboticsWorld Models

  5. OopsieVerse: A Safety Benchmark with Damage-Aware Simulation for Robot Manipulation

    Jun 30, 2026Arnav Balaji, Arpit Bahety, Sriniket Ambatipudi +3Robotics SimulationRobot Safety

  6. RoboTacDex: A Dexterous Visual-Tactile-Action Dataset for Humanoid Manipulation

    Jun 30, 2026Xinyi Wang, Donghan Li, Zi'Ang Chen +5Bimanual Robotic ManipulationRobotic Data Collection

  7. Labimus: A Simulation and Benchmark for Humanoid Dexterous Manipulation in Chemical Laboratory

    Jun 30, 2026Yuhan Wu, Zhao Jin, Tao Li +9Dexterous ManipulationLong-Horizon Robotic Manipulation

  8. From Grasps to Dexterity: Large-Scale Grasp Pretraining for Dexterous Manipulation

    Jun 29, 2026Ying Yuan, Xinyu Liu, Sriram Krishna +1Robotic GraspingDexterous Manipulation

  9. What Enables In-Context Behavior Prompting for Manipulation?

    Jun 29, 2026Austin Patel, Ben Pekarek, Joel Enrique Castro Hernandez +1Robot Skill LearningVisuomotor Policy Learning

  10. Position: Vision-Language-Action Models Cannot Be Verified to Perform Physical Reasoning

    Jun 28, 2026Taozhao Chen, Ian Manchester, Huaming ChenVLM EvaluationPhysical Reasoning

  11. SurgVLA-Bench: Towards Evaluating Vision-Language-Action Models for Laparoscopic Surgical Robotics

    Jun 28, 2026Jiashuo Sun, Yue He, Wenxuan Liu +4Vision-Language-Action ModelsRobot Manipulation Benchmarks

  12. Learning Motion Feasibility from Point Clouds in Cluttered Environments

    Jun 25, 2026Sajid Ansari, Arthi, Girish Varma +1Robotic GraspingPoint Cloud Learning

  13. World Value Models for Robotic Manipulation

    Jun 23, 2026Zhihao Wang, Jianxiong Li, Yu Cui +4Robot Policy LearningWorld Models for Robotics

  14. RoboGaze: Evaluating Robot World Models via Structured Vision-Language Analysis

    Jun 22, 2026Minh-Loi Nguyen, Nghiem Tuong Diep, Hung Khang Nguyen +10VLM EvaluationRobot Manipulation Benchmarks

  15. R2HandoverSim: A Simulation Framework and Benchmark for Robot-to-Human Object Handovers

    Jun 19, 2026Hanxin Zhang, Abdulqader Dhafer, Hongbiao Dong +1Robotic GraspingRobotics Simulation

  16. Inductive Generalization for Robotic Manipulation

    Jun 19, 2026Annabella Macaluso, Haochen Zhang, Ishaan Masilamony +2OOD GeneralizationGeneralization in Robotic Manipulation

  17. EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies

    Jun 18, 2026Ganlin Yang, Zhangzheng Tu, Yuqiang Yang +10Long-Horizon Robotic ManipulationVision-Language-Action Models

  18. A Scalable Embodied Intelligence Platform for Seamless Real-to-Sim-to-Real Transfer of Household Mobile Manipulation Tasks

    Jun 17, 2026Kui Yang, Xianlei Long, Haoxuan Li +2Mobile ManipulationRobotics Simulation

  19. WireCraft: A Simulation Benchmark for Industrial DLO Manipulation

    Jun 16, 2026Chongyu Zhu, Ramy ElMallah, Hyegang Kim +5Robot Policy LearningRobotics Simulation

  20. HumanoidArena: Benchmarking Egocentric Hierarchical Whole-body Learning

    Jun 16, 2026Taowen Wang, Zikang Xie, Bin Yang +13Humanoid Robot ControlHierarchical RL

  21. Abstention-Aware Personalized Object Rearrangement via Uncertainty-Guided LLM Assistance

    Jun 15, 2026Sam Collin, Ali AyubSelective PredictionRobot Task Planning

  22. Scaling Short-Term Memory of Visuomotor Policies for Long-Horizon Tasks

    Jun 15, 2026Rutav Shah, Rajat Kumar Jenamani, Xiaohan Zhang +5Long-Horizon Robotic ManipulationVisuomotor Policy Learning