Benchmark
OpenBenchmark
What is OpenBenchmark?
Evaluates AI agents and models on user-defined tasks generated from imported agent trajectories, scoring correctness, cost, and speed.
- Released
- 2026-08-20
- Evaluates
- Agents, General AI, Language & Knowledge
- Openness
- unknown
- Importer
- Claire Radar
- Review status
- ai-name-audit-deferred
- Reported scores
- 0
Source provenance
- Original evidence https://github.com/crispyberry/OpenBenchmark
OpenBenchmark code
No reported scores are on record for this benchmark yet.