Benchmark Radar
AI BENCHMARK PROFILE

InstructMove

Robotics & Autonomous SystemsRobotics & Embodied IntelligenceHorizon Robotics

Evaluates instruction-following in robot manipulation through pick-and-place tasks requiring language grounding across category, attribute, spatial, and compositional skills.

Released
2026-08-24
Readiness
Runnable
Primary field
Robotics & Autonomous Systems

Why it matters

Provides a controlled testbed to diagnose visual shortcut learning in vision-language-action policies, improving reliability of language-conditioned manipulation.

Motivation

Vision-language-action (VLA) models have made general-purpose robot manipulation increasingly plausible by conditioning robot actions on natural-language instructions.

Primary resources

Benchmark Radar records only publicly supported details and links back to primary sources for verification.