Behavior Cloning

Latest papers 77

All topics
CardsList
  1. Plan-Conditioned Imitation for Robust Object Retrieval under Self-Occlusion in Dense Clutter

    Sep 30, 2026Kowndinya Boyalakuntla, Ajinkya Pawar, Abdeslam Boularias +1Behavior CloningOcclusion

  2. Diffusion-2BC: Hybrid Diffusion and Regression Training for Offline Behavior Cloning in Autonomous Driving

    Sep 29, 2026Bruno Maciel Machado, Eric Aislan AntoneloBehavior CloningDiffusion Policies

  3. Disagreement-Regularized Imitation Learning for Image-Based Continuous Control with Gaussian and Beta Policies

    Sep 29, 2026Irving Giovani Bronzatti Petrazzini, Eric Aislan AntoneloStrong Imitation LearningImitation Learning

  4. Training-free Behavior Cloning

    Sep 24, 2026Maximilian Adang, Timothy Chen, Lars Osterberg +2Behavior CloningModel Predictive Control

  5. KeyGen: Unsupervised Keypoint based Object-Centric Representations for Category-Level Policy Generalization

    Sep 23, 2026Shuxin Cao, Liquan Wang, Masoud Moghani +2Robotic Manipulation PoliciesKeypoint Detection

  6. Non-Commutative State Tracking with Input-Dependent Low-Rank Updates in Mamba-3

    Sep 23, 2026Hiroki Fujii, Masaki YamakitaRecurrent StateMamba

  7. Learning Beyond What Humans Can Demonstrate

    Sep 21, 2026Yuchen Song, Aditya Mittal, Unnat JainTeleoperationBehavior Cloning

  8. HIL-UMI: Bringing Human-in-the-Loop Post-Training of Vision-Language-Action Models to Universal Manipulation Interface

    Sep 17, 2026Zimu Han, Yiming Zeng, Jiyao Zhang +9Generalist Vision--Language--ActionHuman-In-The-Loop

  9. DIA: Denoising Intermediate Advantage for Diffusion Policy Optimization

    Sep 10, 2026Arjun Sohal, Yuchi Zhao, Miroslav Bogdanovic +1Diffusion PoliciesRobot Policies

  10. A Low-Cost, Open Platform for End-to-End Autonomous Driving on a Miniature Ackermann Vehicle

    Sep 3, 2026Gustavo Claudio Karl Couto, Eric Aislan Antonelo, Gabriel George ZippererAutonomous Driving SimulationAutonomous Driving

  11. Out-of-Distribution Generalisation with Sequence Models in Offline Multi-Agent Reinforcement Learning

    Sep 3, 2026Oussama Hidaoui, Omer Ebead, Ulrich Armel Mbou Sob +14Multi-Agent Reinforcement LearningOut-Of-Distribution

  12. Enhancing Visual Domain Robustness in Behaviour Cloning via Saliency-Guided Augmentation

    Aug 12, 2026Zheyu Zhuang, Ruiyu Wang, Nils Ingelhag +2Behavior CloningAugmentation

  13. In-Context VLA: Endowing Vision-Language-Action Models with Language via In-Context Post-Training and Agentic Tool Use

    Aug 6, 2026Jiarui Yang, Wen Huang, Jiale Zhang +2Behavior Cloning

  14. Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents

    Aug 4, 2026William Bolton, Philip TorrClinical TrialsClinical Decision Support

  15. Why Does Action Chunking Improve Behavioral Cloning Performance in Robotic Control?

    Aug 3, 2026Filippo Lazzati, Kyle Stachowicz, William Chen +3Action ChunksRobot Policies

  16. Mirror Learning

    Jul 30, 2026Yunpeng Liu, Matthew Niedoba, Oluwanifemi A. Adekanye +4Imitation LearningBehavior Cloning

  17. Generalizable VLA Finetuning via Representation Anchoring and Language-Action Alignment

    Jul 15, 2026Dwip Dalal, Shivansh Patel, Chahit Jain +8Vision-Language AlignmentBehavior Cloning

  18. A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer

    Jul 12, 2026Haitong Ma, Haldun Balim, Yang Hu +2Diffusion PoliciesBehavior Cloning

  19. VINE: Taming Generative Control Policies for Reinforcement Learning

    Jul 11, 2026Rushuai Yang, Zhuo Han, Houlin Li +10Flow PoliciesGenerative Control Policies

  20. Implicit Behavior Coordination from Sub-Task Demonstrations by Exploiting Overlap-Induced Multimodality

    Jul 10, 2026Ahmed Shokry, Usama Ahmed Siddiquie, Sicong Pan +1Human-To-Robot TransferBehavior Cloning

  21. EgoWAM: World Action Models Beyond Pixels with In-the-Wild Egocentric Human Data

    Jul 8, 2026Baoyu Li, Xinchen Yin, Mengying Lin +2Egocentric DatasetHuman-To-Robot Transfer

  22. A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training

    Jul 6, 2026Junze Ye, Jiayi Cheng, Miao Lu +3On-PolicyTeacher

  23. Behavior Cloning is Not All You Need: The Optimality of On-Policy Distillation for Noisy Expert Feedback

    Jun 29, 2026Ved Sriraman, Peihan Liu, Daniel Hsu +1Off-Policy LearningImitation Learning

  24. Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering

    Jun 28, 2026Hao Wang, Jiuzhou Lei, Dayou Li +5Behavior CloningRobot Policies

  25. Scalable Behavior Cloning with Open Data, Training, and Evaluation

    Jun 25, 2026Arthur Allshire, Himanshu Gaurav Singh, Ritvik Singh +15Behavior CloningTeleoperation

  26. Flowing With Purpose: Latent Action Guided Flow Matching Policies For Robotic Manipulation

    Jun 22, 2026Bruno Machado, Alexandre Chapin, Emmanuel Dellandrea +1Multimodal Action DistributionsRobotic Manipulation

  27. HiL-ResRL: A Model-Agnostic Finetuning Adapter via Human-in-the-loop Residual Reinforcement Learning

    Jun 22, 2026Jingyi Liu, Zhaohong Mai, ShunSen He +5Scalable Robot LearningBehavior Cloning

  28. Provably Efficient Policy-Reward Co-Pretraining for Adversarial Imitation Learning

    Jun 20, 2026Tian Xu, Zexuan Chen, Zhilong Zhang +4Behavior Cloning

  29. Decoupling the Declarative from the Procedural in Vision-Language-Action Models

    Jun 19, 2026Nikolaos Tsagkas, Andreas Sochopoulos, Chris Xiaoxuan Lu +2Diffusion-Based Vision-Language-ActionsLarge-Scale Robot Demonstration Datasets

  30. MirrorDuo: Reflection-Consistent Visuomotor Learning from Mirrored Demonstration Pairs

    Jun 18, 2026Zheyu Zhuang, Ruiyu Wang, Giovanni Luca Marchetti +2Behavior CloningVisuomotor Control

  31. Skill-Guided Continuation Distillation for GUI Agents

    Jun 17, 2026Zhimin Fan, Hongwei Yu, Yeqing Shen +9Unsupervised Skill DiscoveryGraphical User Interface Agents

  32. Hierarchical Advantage Weighting for Online RL Fine-Tuning of VLAs from Sparse Episode Outcomes

    Jun 15, 2026Tongyan Fang, Siyuan Huang, Naiyu Fang +6Hierarchical Reinforcement LearningReinforcement Fine-Tuning

  33. Test-Time Gradient Guidance of Flow Policies in Reinforcement Learning

    Jun 9, 2026Zhiyuan Zhou, Andy Peng, Charles Xu +4Flow PoliciesDiffusion-Based Reinforcement Learning Methods

  34. MODIP: Efficient Model-Based Optimization for Diffusion Policies

    Jun 9, 2026Zakariae El Asri, Philippe Gratias-Quiquandon, Nicolas Thome +1Diffusion PoliciesOffline Reinforcement Learning

  35. What Demonstration Curation Metrics Do to Your Policy

    Jun 8, 2026Aarav BediData-CurationReceiver Operating Characteristic Area Under The Curve

  36. Difference-Aware Retrieval Policies for Imitation Learning

    Jun 8, 2026Quinn Pfeifer, Ethan Pronovost, Paarth Shah +3Imitation LearningBehavior Cloning

  37. Learning from Human Driving: A Human-in-the-Loop Online Behavior Cloning Framework for Autonomous Driving

    Jun 6, 2026Yuhong Shi, Jianyi Liu, Lihang Sun +2Autonomous DrivingHuman Driving

  38. VoxCPM2 Technical Report

    Jun 5, 2026Yixuan Zhou, Guoyang Zeng, Xin Liu +15Cross-Lingual Voice CloningTechnical Report

  39. Auditing Demonstration Curation Metrics: Action-Only Scorers Fail on the Structural Defects That Degrade Imitation Policies

    Jun 4, 2026Aarav BediBehavior CloningDefect

  40. Potential-Guided Flow Matching for Vision-Language-Action Policy Improvement

    Jun 3, 2026Yunpeng Mei, Jiakai He, Hongjie Cao +12Flow-Matching Vision-Language-ActionBehavior Cloning

  41. Set-Supervised Diffusion Policy: Learning Action-Chunking Diffusion through Corrections

    Jun 1, 2026Zhaoting Li, Gang Chen, Javier Alonso-Mora +2Diffusion PoliciesBehavior Cloning

  42. Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies

    May 31, 2026Hikmet Simsir, Ozgur S. OguzOffline Reinforcement LearningBehavior Cloning

  43. Decoupled Behavioral Cloning for Scalable Inductive Generalization in RL from Specifications

    May 30, 2026Vignesh Subramanian, Subhajit Roy, Suguman BansalBehavior CloningFrictive Policy Optimization

  44. Behavior Cloning of MPC for 3-DOF Robotic Manipulators

    May 29, 2026Theo Guegan, Dexter Wen Jie TeoModel Predictive ControlRobotic Manipulator

  45. Affective Music Recommendation: A Rollout-Based World Model for Offline Preference Optimization

    May 27, 2026Audrey Chan, Aaron Labbé, Jacob Lavoie +4Affective ComputingBehavior Cloning

  46. Frequency-Guided Action Diffusion via Sub-Frequency Manifold Traversal

    May 27, 2026Junlin WangDiffusion PoliciesVisuomotor Policy

  47. VR-DAgger: Immersive VR for Dexterous Data Collection and Uncertainty-Guided On-Policy Correction

    May 26, 2026René Zurbrügg, Tifanny Portela, Arjun Bhardwaj +3TeleoperationBehavior Cloning

  48. Adversarial Dual On-Policy Distillation from Expressive Teacher

    May 26, 2026Zhenglin Wan, Jingxuan Wu, Xingrui Yu +5Multimodal Action DistributionsBehavior Cloning

  49. A Systematic Study of Behavioral Cloning for Scientific Data Annotation

    May 26, 2026Ishaan Singh Chandok, Core Francisco ParkBehavior CloningHuman Annotations