Benchmark
VARM-Bench
What is VARM-Bench?
VARM-Bench evaluates verifiable structured reasoning in Chinese abusive-speech moderation. It uses field-anchored chain-of-thought rationales with six decision…
- Released
- 2026-08-16
- Evaluates
- General AI, Reasoning, Speech & Audio
- Openness
- unknown
- Importer
- Claire Radar
- Review status
- unreviewed
- Reported scores
- 0
Source provenance
- Original evidence https://arxiv.org/abs/2608.15600
VARM-Bench paper
No reported scores are on record for this benchmark yet.