Benchmark

Single-answer Atomic Long-form Target (SALT) Benchmark

What is Single-answer Atomic Long-form Target (SALT)?

SALT is a procedurally generated benchmark for evaluating correctness and uncertainty estimates in long-form language-model outputs against deterministic…

Released
2026-07-04
Evaluates
General AI, Language & Knowledge, cs.AI
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

Single-answer Atomic Long-form Target (SALT) paper and code

No reported scores are on record for this benchmark yet.

Which sources cite Single-answer Atomic Long-form Target (SALT)?

Related General AI, Language & Knowledge, cs.AI benchmarks