Benchmark

VRL-Bench

What is VRL-Bench?

VRL-Bench is described as a harness for evaluating agents on computer control tasks under finite trial budgets, focused on trial-and-error learning.

Released
2026-09-11
Evaluates
General AI, Language & Knowledge, cs.AI
Openness
unknown
Importer
Claire Radar
Review status
ai-name-audit-deferred
Reported scores
0

Source provenance

VRL-Bench paper

No reported scores are on record for this benchmark yet.

Which sources cite VRL-Bench?

Related General AI, Language & Knowledge, cs.AI benchmarks