Benchmark

SafeAtlas-Bench

What is SafeAtlas-Bench?

Evaluates multimodal safety moderation via 5,000-instance held-out set with five-level ordered risk predictions and continuous scores across 15 harm categories.

Released
2026-08-29
Evaluates
General AI, Multimodal, Safety, Safety & Trustworthiness
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

SafeAtlas-Bench paper

No reported scores are on record for this benchmark yet.

Which sources cite SafeAtlas-Bench?

Related General AI, Multimodal, Safety, Safety & Trustworthiness benchmarks