What it measures
Open-world humanoid manipulation across dexterous object manipulation, human-humanoid interaction and loco-manipulation. The dataset is a training resource; the planned cloud evaluation would score deployed policies on real humanoids.