Benchmark

SWORD Benchmark

What is SWORD?

A benchmark of syntactically correct but factually incorrect statements across eight languages for evaluating multilingual factual error rejection.

Released
2026-09-08
Evaluates
Factuality, General AI, Language & Knowledge, cs.CL
Openness
unknown
Importer
Claire Radar
Review status
ai-name-audit-deferred
Reported scores
0

Source provenance

SWORD paper

No reported scores are on record for this benchmark yet.

Which sources cite SWORD?

Related Factuality, General AI, Language & Knowledge, cs.CL benchmarks