Benchmark

HopRefusalBench

What is HopRefusalBench?

HopRefusalBench evaluates refusal behavior of search-augmented language model agents on multi-hop questions that are unanswerable, covering three causes of…

Released
2026-08-02
Evaluates
General AI, Language & Knowledge, Reasoning
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

HopRefusalBench paper

No reported scores are on record for this benchmark yet.

Which sources cite HopRefusalBench?

Related General AI, Language & Knowledge, Reasoning benchmarks