Benchmark

EvoHarmBench

What is EvoHarmBench?

Evaluates content moderation systems against iteratively evolved adversarial samples across 229 semantic sub-clusters and five violation categories, with…

Released
2026-08-28
Evaluates
Factuality, General AI, Language & Knowledge, cs.CL
Openness
unknown
Importer
Claire Radar
Review status
ai-name-audit-deferred
Reported scores
0

Source provenance

EvoHarmBench paper

No reported scores are on record for this benchmark yet.

Which sources cite EvoHarmBench?

Related Factuality, General AI, Language & Knowledge, cs.CL benchmarks