Benchmark
HumanCLAW-Bench
What is HumanCLAW-Bench?
HumanCLAW-Bench evaluates how VLMs make embodied decisions. Its 1,218 humanoid find-navigate-interact episodes span 41 indoor scenes, and low-level motor…
- Released
- 2026-07-29
- Evaluates
- Multimodal, Robotics & Embodied AI
- Openness
- unknown
- Importer
- Claire Radar
- Review status
- ai-reviewed
- Reported scores
- 0
Source provenance
- Original evidence https://arxiv.org/abs/2607.27180
HumanCLAW-Bench paper
No reported scores are on record for this benchmark yet.