Visual Acuity Test for LLMs

Test Image (4K)

Visual Acuity Test Chart
Click image to expand/collapse

Leaderboard (4K)

RankModelProviderInput TokensOutput TokensThreshold RowThreshold SizeMean AccuracyAttempted Rows
1T GPT-5.4 (original detail) OpenAI 12,045 198
12
6px 100.0% 12/12
2T GPT-5.5 (none) OpenAI 12,045 198
12
6px 100.0% 12/12
3T GPT-5.6 (none) OpenAI 19,705 198
12
6px 100.0% 12/12
4T GPT-5.6-LUNA (none) OpenAI 19,705 198
12
6px 100.0% 12/12
5T GPT-5.6-TERRA (none) OpenAI 19,705 185
12
6px 100.0% 12/12
6 GPT-5.6 (none) (high detail) OpenAI 3,045 198
12
6px 96.7% 12/12
7 Claude Opus 4 7 (no thinking) (effort: low) Anthropic 4,822 312
12
6px 91.7% 12/12
8T Gemini 3 Flash Preview (thinking: minimal) (high res) Gemini 1,129 242
11
8px 95.0% 12/12
9T Gemini 3 Pro Preview (high res) Gemini 1,129 242
11
8px 95.0% 12/12
10 Claude Opus 4 8 (no thinking) (effort: low) Anthropic 4,816 313
10
10px 90.0% 12/12
11 GPT-5-MINI (minimal) OpenAI 1,870 199
10
10px 89.1% 11/12
12 GPT-4.1-NANO (high detail) OpenAI 3,788 160
10
10px 88.0% 10/12
13T GPT-4.1-MINI OpenAI 2,511 183
10
10px 86.7% 12/12
14T GPT-4.1-MINI (low detail) OpenAI 2,511 195
10
10px 86.7% 12/12
15 GPT-4.1-MINI (high detail) OpenAI 2,511 200
10
10px 85.0% 12/12
16T Claude Fable 5 (effort: low) Anthropic 4,816 355
10
10px 83.3% 12/12
17T Claude Sonnet 5 (no thinking) (effort: low) Anthropic 4,816 332
10
10px 83.3% 12/12
18 Grok 4.5 (low) xAI 2,649 220
10
10px 81.7% 12/12
19 Gemini 3 Pro Preview (medium res) Gemini 569 198
9
12px 97.8% 9/12
20 GPT-4.1-NANO (low detail) OpenAI 3,788 165
9
12px 90.0% 10/12
21 Gemini 3 Flash Preview (thinking: minimal) (medium res) Gemini 569 212
8
15px 73.3% 12/12
22 Gemini 3 Pro Preview (low res) Gemini 296 185
7
19px 87.5% 8/12
23 Claude Haiku 4 5 20251001 Anthropic 1,571 226
7
19px 74.0% 10/12
24 Gemini 2.5 Pro Gemini 298 214
7
19px 61.8% 11/12
25 Gemini 3 Flash Preview (thinking: minimal) (low res) Gemini 296 265
7
19px 61.7% 12/12
26T Claude Sonnet 4 5 20250929 Anthropic 1,571 292
7
19px 60.0% 12/12
27T Claude Sonnet 4 6 (no thinking) (effort: low) Anthropic 1,571 314
7
19px 60.0% 12/12
28 GPT-4.1 OpenAI 810 272
7
19px 58.3% 12/12
29T Claude Opus 4 5 20251101 Anthropic 1,571 289
7
19px 56.7% 12/12
30T Claude Opus 4 6 (no thinking) (effort: low) Anthropic 1,571 221
7
19px 56.7% 12/12
31T GPT-5 (minimal) OpenAI 674 225
7
19px 56.7% 12/12
32 GPT-4O (high detail) OpenAI 810 167
7
19px 55.0% 12/12
33 Gemini 2.0 Flash (high res) Gemini 3,393 122
6
24px 100.0% 6/12
34 Claude Sonnet 4 20250514 Anthropic 1,571 206
6
24px 94.3% 7/12
35 Gemini 2.0 Flash (medium res) Gemini 297 180
6
24px 71.1% 9/12
36 Claude Opus 4 1 20250805 Anthropic 1,571 296
6
24px 64.0% 10/12
37 Gemini 2.5 Flash (no thinking) (medium res) Gemini 298 252
6
24px 56.7% 12/12
38 Gemini 2.5 Pro (low res) Gemini 106 136
6
24px 56.4% 11/12
39T Gemini 2.0 Flash (low res) Gemini 105 164
6
24px 55.0% 12/12
40T Gemini 2.5 Flash (no thinking) Gemini 298 347
6
24px 55.0% 12/12
41T Gemini 2.5 Pro (medium res) Gemini 298 239
6
24px 55.0% 12/12
42 GPT-4O-MINI (high detail) OpenAI 25,546 302
6
24px 51.7% 12/12
43 GPT-4O-MINI (low detail) OpenAI 2,878 145
4
38px 42.0% 10/12
44 Grok 4 0709 xAI 978 60
3
48px 85.0% 4/12
45T GPT-5.5 (none) (low detail) OpenAI 352 248
2
60px 16.7% 12/12
46T GPT-5.6 (none) (low detail) OpenAI 352 246
2
60px 16.7% 12/12
47 GPT-4O (low detail) OpenAI 130 22
None
N/A 0.0% 0/12
Click a row to see detailed results
Use ← → arrow keys to navigate between models when a card is open

Test Image (1K)

Visual Acuity Test Chart
Click image to expand/collapse

Leaderboard (1K)

RankModelProviderInput TokensOutput TokensThreshold RowThreshold SizeMean AccuracyAttempted Rows
1T Claude Haiku 4 5 20251001 Anthropic 1,419 251
12
6px 100.0% 12/12
2T Claude Opus 4 5 20251101 Anthropic 1,419 227
12
6px 100.0% 12/12
3T Claude Sonnet 4 20250514 Anthropic 1,419 227
12
6px 100.0% 12/12
4T Claude Sonnet 4 5 20250929 Anthropic 1,419 275
12
6px 100.0% 12/12
5T GPT-4.1 OpenAI 810 253
12
6px 100.0% 12/12
6T GPT-4.1-MINI OpenAI 1,705 195
12
6px 100.0% 12/12
7T GPT-4.1-MINI (high detail) OpenAI 1,705 195
12
6px 100.0% 12/12
8T GPT-4.1-MINI (low detail) OpenAI 1,705 195
12
6px 100.0% 12/12
9T GPT-4.1-NANO (high detail) OpenAI 2,566 195
12
6px 100.0% 12/12
10T GPT-4.1-NANO (low detail) OpenAI 2,566 195
12
6px 100.0% 12/12
11T GPT-5 (minimal) OpenAI 674 200
12
6px 100.0% 12/12
12T GPT-5-MINI (minimal) OpenAI 1,273 188
12
6px 100.0% 12/12
13T GPT-5.4 (original detail) OpenAI 1,273 198
12
6px 100.0% 12/12
14T Gemini 2.5 Flash (no thinking) Gemini 298 202
12
6px 100.0% 12/12
15T Gemini 2.5 Flash (no thinking) (medium res) Gemini 298 202
12
6px 100.0% 12/12
16T Gemini 2.5 Pro Gemini 298 212
12
6px 100.0% 12/12
17T Gemini 2.5 Pro (medium res) Gemini 298 212
12
6px 100.0% 12/12
18T Gemini 3 Flash Preview (thinking: minimal) (high res) Gemini 1,129 185
12
6px 100.0% 12/12
19T Gemini 3 Flash Preview (thinking: minimal) (low res) Gemini 296 242
12
6px 100.0% 12/12
20T Gemini 3 Flash Preview (thinking: minimal) (medium res) Gemini 569 242
12
6px 100.0% 12/12
21T Gemini 3 Pro Preview (high res) Gemini 1,129 212
12
6px 100.0% 12/12
22T Gemini 3 Pro Preview (low res) Gemini 296 232
12
6px 100.0% 12/12
23T Gemini 3 Pro Preview (medium res) Gemini 569 232
12
6px 100.0% 12/12
24T Claude Opus 4 1 20250805 Anthropic 1,419 230
12
6px 98.3% 12/12
25T Gemini 2.0 Flash (medium res) Gemini 297 255
12
6px 98.3% 12/12
26 GPT-4O (high detail) OpenAI 810 193
12
6px 68.3% 12/12
27 Gemini 2.0 Flash (high res) Gemini 1,329 182
10
10px 100.0% 10/12
28 Grok 4 0709 xAI 978 191
9
12px 75.0% 12/12
29 Gemini 2.0 Flash (low res) Gemini 105 208
2
60px 23.6% 11/12
30 Gemini 2.5 Pro (low res) Gemini 106 196
1
76px 30.9% 11/12
31 GPT-4O-MINI (high detail) OpenAI 25,546 199
1
76px 23.6% 11/12
32 GPT-4O-MINI (low detail) OpenAI 2,878 186
1
76px 18.0% 10/12
33 GPT-4O (low detail) OpenAI 130 40
None
N/A 0.0% 0/12
Click a row to see detailed results
Use ← → arrow keys to navigate between models when a card is open