Benchmark

VARM-Bench

What is VARM-Bench?

VARM-Bench evaluates verifiable structured reasoning in Chinese abusive-speech moderation. It uses field-anchored chain-of-thought rationales with six decision…

Released
2026-08-16
Evaluates
General AI, Reasoning, Speech & Audio
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

VARM-Bench paper

No reported scores are on record for this benchmark yet.

Which sources cite VARM-Bench?

Related General AI, Reasoning, Speech & Audio benchmarks