Benchmark

EvoClawBench

What is EvoClawBench?

EvoClawBench evaluates whether an agent runtime can convert evidence from its own runs into reusable skills that improve fresh executions. It covers 100 tasks…

Released
2026-06-23
Evaluates
General AI, Language & Knowledge, cs.LG
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

EvoClawBench paper

No reported scores are on record for this benchmark yet.

Which sources cite EvoClawBench?

Related General AI, Language & Knowledge, cs.LG benchmarks