Robot Manipulation Benchmarks

Latest papers 200

All topics
CardsList
  1. RoboIRGBench: Benchmarking Implicit Referential Grounding in Vision-Language-Action Models

    Sep 28, 2026Aernaer Akelijiang, Jiannan Li, Zhineng Chen +2Language-Conditioned Robot ManipulationVision-Language-Action Models

  2. CodeActionBench: Evaluating Agentic Code-as-Policy for Embodied Manipulation

    Sep 27, 2026Yiheng Lyu, Xueying Jiang, Wenhao Li +2Robotic Policy EvaluationRobotic Manipulation

  3. RoboRecover: Benchmarking Robot Policy Recovery under Execution Deviations

    Sep 24, 2026Yang Li, Chen Zhao, Zhuoran Wang +5Robotic Policy EvaluationRobot Manipulation Benchmarks

  4. TriWorldBench: A Tri-View Consistency Perspective on Embodied World Models

    Sep 22, 2026Xuanyi Liu, Haofeng Wang, Ruiqi Li +9World Model LearningRobot Manipulation Benchmarks

  5. RoboTwin-Phys: Do WAMs and VLAs Understand the Physical World?

    Sep 22, 2026Jiaqi Zhang, Feng Ye, Mingjia Yang +6Generalization in Robotic ManipulationRobotic Manipulation

  6. MotionForge: A Data Generation Pipeline and Large-Scale Benchmark for Long-Horizon Manipulation of Dynamic Objects with Domain Shifts

    Sep 22, 2026Mohan Liu, Dengchen Mei, Haotian Xian +7Long-Horizon Robotic ManipulationGeneralization in Robotic Manipulation

  7. RoboFollow: Unveiling the Instruction Following Mirage in Embodied Agents

    Sep 22, 2026Chang Guo, Yukun Xie, Bohan Tan +6Language-Conditioned Robot ManipulationRobotic Policy Evaluation

  8. IndustrialVLA-Bench: A Traceable Multi-Axis Evaluation of Open Robot Policy Models

    Sep 22, 2026Yiqi Wang, Zhifeng Rao, Jiaqi Zhang +7Robotic Policy EvaluationVision-Language-Action Models

  9. H2RBench: A Real-to-Sim Benchmark for Evaluating Human-to-Robot Transfer

    Sep 21, 2026Chuyang Xiao, Haotian Zhan, Sriram Krishna +4Cross-Embodiment Robot LearningRobotic Manipulation

  10. LIBERO-VPro: Benchmarking Closed-Loop Visual Robustness of Robotic Foundation Models

    Sep 21, 2026Huiqiong Li, Zhiting Mei, Anirudha Majumdar +3World Models for RoboticsRobot Foundation Models

  11. An Unexpected Robot Policy: Early Evaluations of GPT-6 Astra on RoboDojo and Beyond

    Sep 21, 2026Wenbo Zhang, Kaixuan Wang, Yutao Ouyang +9Language-Conditioned Robot ManipulationGeneralization in Robotic Manipulation

  12. ActiveArena: Benchmarking and Understanding Active Perception in Robotic Manipulation

    Sep 21, 2026Yibo Li, Enshen Zhou, Rui Chen +7Memory-Augmented VLMsActive Perception

  13. CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies

    Sep 21, 2026Junlan Xiao, Junwei Jiang, Zaibin Zhang +4Long-Horizon Robotic ManipulationVision-Language-Action Models

  14. PackLab: A Comprehensive Framework for Developing, Training, and Evaluating MLLMs in Robotic Bin Packing

    Sep 20, 2026Donghao Zhou, Jia-Hui Pan, Fan Zhang +6Long-Horizon Robotic ManipulationRobotics

  15. VABench: Measuring Embodied Spatial Intelligence through Visual Demonstrations, Active Perception, and Metric Control

    Sep 17, 2026Zhongbo Zhang, Jiayi Jin, Yifan Wang +4Active PerceptionSpatial Reasoning Benchmarks

  16. CANTABILE: Learning Expressive Dynamics for Robotic Piano Performance

    Sep 16, 2026Woosik Kim, Wonhyeok Choi, Sunghoon ImBimanual Robotic ManipulationDynamic Robotic Manipulation

  17. RoboVAD: A Large Cross-Domain Evaluation Benchmark for Anomaly Detection in Robotic Arm Manipulation Videos

    Sep 15, 2026Alexandru-Bogdan Dura, Sebastian Balmus, Radu Tudor IonescuRobot Manipulation BenchmarksVideo Anomaly Detection

  18. BRAVE-6D: Benchmark for Robotic Active Vision in 6DOF Pose Estimation

    Sep 15, 2026Philipp Ausserlechner, Bernhard Neuberger, Alessandro Scherl +3Object Pose EstimationRobot Manipulation Benchmarks

  19. TEMPO: Learning Temporal Context for Dynamic Robot Manipulation

    Sep 15, 2026Zhenyang Feng, Jimin Heo, Erik B. Sudderth +1Robotic ManipulationVision-Language-Action Models

  20. Bench2Dex: Benchmarking Visuo-Tactile Bimanual Dexterous Manipulation Across Dexterous Hands

    Sep 14, 2026Zhenjie Yang, Yideng Zhang, Dongjie Zhang +21Dexterous ManipulationBimanual Robotic Manipulation

  21. FolDeX: A Physical-World Benchmark for Long-Horizon Robotic Manipulation of Deformable Objects

    Sep 9, 2026Chenhuan Liu, Yi Xu, Feng Wu +7Long-Horizon Robotic ManipulationBimanual Robotic Manipulation

  22. Monkey See, Can Monkey Do? A Benchmark for Evaluating Robot Skill Learning by Observation

    Sep 8, 2026Weiwei Gu, Anmol Gupta, Anant Sah +5Long-Horizon Robotic ManipulationRobot Skill Learning

  23. LIBERO-RECOVER: Beyond Task Success Towards Failure Recovery in Robotic Manipulation Models

    Sep 4, 2026Lin Liu, Zhicheng Bao, Lu Zhang +7Robot Failure RecoveryRobotic Manipulation

  24. FailBench: How Reliable are VLMs at Judging Robot Task Success?

    Sep 3, 2026Zaruhi Navasardyan, Tatul Danielyan, Hrant DavtyanVLM EvaluationRobot Failure Detection

  25. ZETA: A Controlled Study of Zero-Shot Cross-Embodiment VLA Transfer for Tabletop Manipulation

    Sep 2, 2026Mi Yan, Wenhao Zhang, Zhiqi Zhang +14Cross-Embodiment TransferVision-Language-Action Models