Benchmark

DocVQAtest

DocVQA is a Visual Question Answering benchmark on document images containing 50,000 questions defined on 12,000+ document images. The benchmark focuses…

Modality
multimodal
Categories
multimodal, vision
Openness
unknown
Source
llm_stats
Reported scores
11

Reported scores

llm_stats

ModelOrganizationReported valueReportedEvidence
Qwen2-VL-72B-InstructQwen0.9652024-08-29evidence
Qwen3 VL 235B A22B InstructQwen0.9712025-09-22evidence
Qwen3 VL 235B A22B ThinkingQwen0.9652025-09-22evidence
Qwen3 VL 30B A3B InstructQwen0.952025-09-22evidence
Qwen3 VL 30B A3B ThinkingQwen0.952025-09-22evidence
Qwen3 VL 32B InstructQwen0.9692025-09-22evidence
Qwen3 VL 32B ThinkingQwen0.9612025-09-22evidence
Qwen3 VL 4B InstructQwen0.9532025-09-22evidence
Qwen3 VL 4B ThinkingQwen0.9422025-09-22evidence
Qwen3 VL 8B InstructQwen0.9612025-09-22evidence
Qwen3 VL 8B ThinkingQwen0.9532025-09-22evidence

Scores are partitioned by the source that reported them and are never merged into a single cross-source ranking, because the sources measure different things and say so.