Reproducible benchmark for evaluating zero-shot syntactic and task-level generalization of state-of-the-art Vision-Language-Action (VLA) models for robotic manipulation.
benchmark robotics evaluation imitation-learning robot-manipulation out-of-distribution-generalization diffusion-policy zero-shot-generalization vision-language-action-model language-conditioned-imitation-learning
-
Updated
Apr 26, 2026 - Python