Benchmark

OpenBenchmark

What is OpenBenchmark?

Evaluates AI agents and models on user-defined tasks generated from imported agent trajectories, scoring correctness, cost, and speed.

Released
2026-08-20
Evaluates
Agents, General AI, Language & Knowledge
Openness
unknown
Importer
Claire Radar
Review status
ai-name-audit-deferred
Reported scores
0

Source provenance

OpenBenchmark code

No reported scores are on record for this benchmark yet.

Which sources cite OpenBenchmark?

Related Agents, General AI, Language & Knowledge benchmarks