Benchmark

refusal-benchmark

What is refusal-benchmark?

Measures LLM refusal rates on a set of harmful prompts via OpenAI-compatible endpoints. Benchmark Radar tracks refusal-benchmark, cited by 1 source documents…

Released
2026-08-22
Evaluates
Finance, Language & Knowledge, cs.AI
Openness
unknown
Importer
Claire Radar
Review status
ai-name-audit-deferred
Reported scores
0

Source provenance

refusal-benchmark code

No reported scores are on record for this benchmark yet.

Which sources cite refusal-benchmark?

Related Finance, Language & Knowledge, cs.AI benchmarks