Benchmark

CAP-Correctness Benchmark

What is CAP-Correctness?

Evaluates semantic correctness of open-domain QA answers using 8.8k examples derived from widely used QA datasets, with a framework for answer verification.

Released
2026-09-01
Evaluates
General AI, Language & Knowledge, cs.CL
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

CAP-Correctness paper

No reported scores are on record for this benchmark yet.

Which sources cite CAP-Correctness?

Related General AI, Language & Knowledge, cs.CL benchmarks