Robot Manipulation Benchmarks

Latest papers 200

All topics
CardsList
  1. ContactWorld: What Representations Matter for Vision-Tactile Latent World Models in Contact-Rich Manipulation

    Jun 11, 2026Zhiyuan Zhang, Pokuang Zhou, Kaidi Zhang +7Representation LearningWorld Models for Robotics

  2. RoboProcessBench: Benchmarking Process-Aware Understanding in Vision-Language Robotic Manipulation

    Jun 11, 2026Dayu Xia, Yue Shi, Yao Mu +7VLM EvaluationRobotic Manipulation

  3. Pipette: An Embodied Simulation Platform, Benchmark, and Data-Efficient Augmentation Framework for Wet-Lab Robotics

    Jun 11, 2026Zhe Liu, Huanbo Jin, Zhaohui Du +10Synthetic Data AugmentationRobotics Simulation

  4. DuoBench: A Reproducible Benchmark for Bimanual Manipulation in Simulation and the Real World

    Jun 10, 2026Tobias Jülg, Seongjin Bien, Simon Hilber +7Bimanual Robotic ManipulationRobotics Simulation

  5. From Simulation to the Real-World: An In-Field 6D Pose Dataset and Baseline for Robotic Strawberry Harvesting

    Jun 9, 2026Woojung Son, Won Suk Lee, Zijing Huang +4Sim-to-Real TransferObject Pose Estimation

  6. Benchmarking Vision-Language-Action Models on SO-101: Failure and Recovery Analysis

    Jun 7, 2026Yi Yu, Xinchuan QiuRobot Policy LearningRobotic Manipulation

  7. Real-IKEA: Physical Fidelity is the Prerequisite for Robust Manipulation

    Jun 7, 2026Kunqi Xu, Zhenhao Huang, Siyuan Luo +2Contact-Rich Robotic ManipulationRobotics Simulation

  8. EmbodimentSemantic: A Spatial Scene-Graph Dataset and Benchmark for Vision-Language Models on Embodied Manipulation Trajectories

    Jun 6, 2026Hassan Jaber, Refinath S N, Luca Cagliero +2Scene Graph GenerationVisual Spatial Reasoning

  9. SIMPLE: Simulation-Based Policy Learning and Evaluation for Humanoid Loco-manipulation

    Jun 6, 2026Songlin Wei, Zhenhao Ni, Jie Liu +9Humanoid Loco-ManipulationRobotics Simulation

  10. Brick-Composer: Using MLLMs for Assembly with Diverse Bricks

    Jun 3, 2026Jiateng Liu, Bingxuan Li, Zhenhailong Wang +8Visual Spatial ReasoningBenchmark Construction

  11. Dream.exe: Can Video Generation Models Dream Executable Robot Manipulation?

    Jun 3, 2026Rui Zhao, Kaiming Yang, Jifeng Zhu +6Physical Consistency in Video GenerationRobotic Manipulation

  12. What Are We Actually Benchmarking in Robot Manipulation?

    Jun 2, 2026Tianchong Jiang, Xiangshan Tan, Samuel Wheeler +3Benchmark DesignBenchmark Contamination

  13. Affordance2Action: Task-Conditioned Scene-level Affordance Grounding for Real-Time Manipulation

    Jun 2, 2026Litao Liu, Yifan Han, Pengfei Yi +9Language-Conditioned Robot ManipulationRobotic Manipulation

  14. WorkBenchMark: A LEGO-Based Assembly Benchmark with an Assembly-by-Disassembly Baseline for the Smart Manufacturing League

    Jun 2, 2026Wenbo Ma, Daniel Swoboda, Matteo Tschesche +1Robotic ManipulationRobot Task Planning

  15. A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning

    Jun 2, 2026Rui Zhang, Qiwei Wu, Zhengyu Zhang +7Robotic RLLearning from Demonstration

  16. SeeTraceAct: Visibility-Aware Latent Planning from Cross-Embodiment Demonstration Videos

    Jun 1, 2026Jaehyeon Son, Junhyun Kim, Kyle Kam +7Robot Skill LearningGeneralization in Robotic Manipulation

  17. RoboTrustBench: Benchmarking the Trustworthiness of Video World Models for Robotic Manipulation

    Jun 1, 2026Huiqiong Li, Jiayu Wang, Zhiting Mei +3World ModelsAI Safety Evaluation

  18. SafeVLA-Bench: A Benchmark for the Success-Safety Gap in Vision-Language-Action Models

    May 30, 2026Jialiang Fan, Weizhe Xu, Zijun Wang +3Robot SafetyRobotic Manipulation

  19. RoboWits: Unexpected Challenges for Robotic Creative Problem Solving

    May 28, 2026Chunru Lin, Hongxin Zhang, Fenghao Yu +5Bimanual Robotic ManipulationRobotics

  20. Colosseum V2: Benchmarking Generalization for Vision-Language-Action Models

    May 26, 2026Jeremy Morgan, Hyeonho Oh, Prajwal Vijay +7Robotics SimulationGeneralization in Robotic Manipulation

  21. FineVLA: Fine-Grained Instruction Alignment for Steerable Vision-Language-Action Policies

    May 26, 2026Xintong Hu, Xuhong Huang, Jinyu Zhang +11Language-Conditioned Robot ManipulationVision-Language-Action Models

  22. OSMa-Bench++: Toward Open-Ended Benchmarking of Semantic Mapping for Manipulation with Prompt-Generated Synthetic Scenes

    May 26, 2026Regina Kurkova, Maxim Popov, Sergey KolyubinRobotics SimulationSynthetic Benchmark Generation

  23. TacO: Benchmarking Tactile Sensors for Object Manipulation

    May 21, 2026Anya Zorin, Zilin Si, Myungsun Park +11Tactile SensingContact-Rich Robotic Manipulation