Benchmark

Rushes Benchmark

What is Rushes?

A dataset and diagnostic benchmark of 44,226 user decisions in AI-generated branching narratives. Models predict each user's choice at the event level.

Released
2026-07-22
Evaluates
General AI, Language & Knowledge, Safety
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

Rushes paper and code

No reported scores are on record for this benchmark yet.

Which sources cite Rushes?

Related General AI, Language & Knowledge, Safety benchmarks