Benchmark

CAREBench

What is CAREBench?

CAREBench evaluates language models on upstream child-safety risks with 500 prompts across twelve categories, assessing recognition, refusal, de-escalation…

Released
2026-06-29
Evaluates
General AI, Safety, Safety & Trustworthiness
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

CAREBench paper

No reported scores are on record for this benchmark yet.

Which sources cite CAREBench?

Related General AI, Safety, Safety & Trustworthiness benchmarks