Benchmark

AgentHPOBench

What is AgentHPOBench?

AgentHPOBench evaluates LLM agents as sequential hyperparameter optimizers across 30 executable ML tasks. Agents observe accumulated configurations, metrics…

Released
2026-07-31
Evaluates
General AI, Language & Knowledge, cs.AI
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

AgentHPOBench paper

No reported scores are on record for this benchmark yet.

Which sources cite AgentHPOBench?

Related General AI, Language & Knowledge, cs.AI benchmarks