🔗 Bridging Modal Isolation in Interleaved Thinking: Supervising Modality Transitions via Stepwise Reinforcement
-
Updated
Jun 10, 2026 - Python
🔗 Bridging Modal Isolation in Interleaved Thinking: Supervising Modality Transitions via Stepwise Reinforcement
Multi-axis VLM-as-judge data curation for robot demonstrations. Five specialist critics (visual / kinematic / task / strategy / safety) score every LeRobot episode with rationale and timestamp evidence. Model-agnostic — any OpenAI-compatible vision endpoint.
Add a description, image, and links to the vlm-as-judge topic page so that developers can more easily learn about it.
To associate your repository with the vlm-as-judge topic, visit your repo's landing page and select "manage topics."