Benchmark

MirageBench

What is MirageBench?

Evaluates LLM personalization faithfulness: 150 personas, 6 tasks, four-way faithfulness taxonomy, 12 models across 7 families, 143,616 judged claims.

Released
2026-08-05
Evaluates
General AI, Language & Knowledge, cs.CL
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

MirageBench paper

No reported scores are on record for this benchmark yet.

Which sources cite MirageBench?

Related General AI, Language & Knowledge, cs.CL benchmarks