Instruction Generalization in VLA Models

VLA: Vision-Language-Action

Latest papers 19

All topics
CardsList
  1. Many Ways to Succeed: Diversity-Driven RL Fine-Tuning for VLA Generalization

    Oct 7, 2026Haoru Li, Jinmei Liu, Zhiyong Wang +5Robot Policy GeneralizationRL Fine-Tuning

  2. TempoBridge: Language-Guided Tempo Control for Vision-Language-Action Policies

    Oct 7, 2026Yeonseo Lee, Hyosup Shin, Guebin Hwang +1Language-Conditioned Robot ControlVision-Language-Action Models

  3. OGAM: Connecting Systematic Testing to Runtime Assurance through Object-Grounded Attention Monitoring for VLA Policies

    Oct 5, 2026Haki Darwish, Xiangyu Yin, Changwen Li +3Instruction Generalization in VLA ModelsRobustness of VLA Models

  4. Same Scene, Different Task: Skill Alignment for Compositional Generalization in VLAs

    Sep 30, 2026Taegeun Yang, Youngju Na, Yoonki Cho +1Vision-Language-Action ModelsCounterfactual Data Augmentation

  5. When Instructions Retrieve Trajectories: Diagnosing and Mitigating Generalization Failures in VLA Models

    Sep 30, 2026Hung-Jen Chen, Yu-Hsun Hou, Yan-Hong Chen +4Robotic ManipulationVision-Language-Action Models

  6. Disentangling Spurious Correlations in Vision-Language-Action Models via Predicting Domain-Invariant Latent Lookahead

    Sep 29, 2026Junghyun Kim, Ngseo Kim, ChungWoo Lee +7Domain GeneralizationVision-Language-Action Models

  7. LexiconVLA: Learning Reusable Atomic Action Codebooks for Unseen Tasks

    Sep 29, 2026Zeming Wei, Jianheng Ye, Xinshuai Song +3Visuomotor Policy LearningRobotic Manipulation

  8. Grounded Semantic Re-Binding for Robust Instruction Generalization in Vision-Language-Action Models

    Aug 3, 2026Zhaokai Yin, Zhipeng ZhangVision-Language GroundingVision-Language-Action Models

  9. Pelican-VLA 0.5: Attending Before Acting Benefits Generalization

    Jul 7, 2026Zeyuan Ding, Wenhai Liu, Yang Xu +6Next-Action PredictionGeneralization in Robotic Manipulation

  10. APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies

    Jun 10, 2026Kechun Xu, Zhenjie Zhu, Anzhe Chen +2Visuomotor Policy LearningVision-Language-Action Models

  11. DISC: Decoupling Instruction from State-Conditioned Control via Policy Generation

    May 20, 2026Hanxiang Ren, Pei Zhou, Xunzhe Zhou +1Language-Conditioned Robot ManipulationVisuomotor Policy Learning

  12. LIBERO-Para: A Diagnostic Benchmark and Metrics for Paraphrase Robustness in VLA Models

    Mar 30, 2026Chanyoung Kim, Minwoo Kim, Minseok Kang +2Vision-Language GroundingVision-Language-Action Models