all the models — AI benchmark observatory
← Benchmarks

DocVQAtest

DocVQA is a Visual Question Answering benchmark on document images containing 50,000 questions defined on 12,000+ document images. The benchmark focuses on understanding document structure and content to answer questions about various document types including letters, memos, notes, and reports from the UCSF Industry Documents Library.

id docvqatest · max 1 · 11 models reported

#ModelScore
1Qwen3 VL 235B A22B Instruct
Alibaba Cloud / Qwen Team · open
0.97
2Qwen3 VL 32B Instruct
Alibaba Cloud / Qwen Team · open
0.97
3Qwen2-VL-72B-Instruct
Alibaba Cloud / Qwen Team · open
0.96
4Qwen3 VL 235B A22B Thinking
Alibaba Cloud / Qwen Team · open
0.96
5Qwen3 VL 32B Thinking
Alibaba Cloud / Qwen Team · open
0.96
6Qwen3 VL 8B Instruct
Alibaba Cloud / Qwen Team · open
0.96
7Qwen3 VL 4B Instruct
Alibaba Cloud / Qwen Team · open
0.95
8Qwen3 VL 8B Thinking
Alibaba Cloud / Qwen Team · open
0.95
9Qwen3 VL 30B A3B Instruct
Alibaba Cloud / Qwen Team · open
0.95
10Qwen3 VL 30B A3B Thinking
Alibaba Cloud / Qwen Team · open
0.95
11Qwen3 VL 4B Thinking
Alibaba Cloud / Qwen Team · open
0.94