Benchmark

AIB Benchmark

What is AIB?

Evaluates large audio language models on 14,829 forced-choice trials across ten auditory illusions, scoring human-likeness and reality alignment.

Released
2026-09-02
Evaluates
Factuality, General AI, Speech & Audio, cs.SD
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

AIB paper and code

No reported scores are on record for this benchmark yet.

Which sources cite AIB?

Related Factuality, General AI, Speech & Audio, cs.SD benchmarks