| # | Model | Vendor | Best score | Runs | Last seen |
|---|---|---|---|---|---|
| 1 | Qwen3.8 Max Preview | Alibaba | 88 | 1 | 2026-08-23 |
| 2 | Qwen3.7 Plus Preview | Alibaba | 86.9 | 2 | 2026-08-24 |
| 3 | Qwen3.8 27B | Alibaba | 85.9 | 2 | 2026-08-24 |
| 4 | Qwen3.6 Plus | Alibaba | 85.4 | 1 | 2026-08-23 |
| 5 | Qwen3.6 35B A3B | Alibaba | 85.3 | 2 | 2026-08-24 |
| 6 | Qwen3.5 122B A10B | Alibaba | 85.1 | 1 | 2026-08-23 |
| 7 | Qwen3.5 35B A3B | Alibaba | 84.1 | 2 | 2026-08-24 |
| 8 | Qwen3.6 27B | Alibaba | 84.1 | 3 | 2026-08-24 |
| 9 | Qwen3.5 397B A17B | Alibaba | 83.9 | 1 | 2026-08-24 |
| 10 | Qwen3.5 27B | Alibaba | 83.7 | 3 | 2026-08-24 |
| 11 | Qwen3 VL 235B A22B Reasoning | Alibaba | 81.3 | 1 | 2026-08-23 |
| 12 | Qwen3 VL 235B A22B Instruct | Alibaba | 79.3 | 1 | 2026-08-23 |
| 13 | Qwen3 VL 32B Instruct | Alibaba | 79 | 1 | 2026-08-23 |
| 14 | Qwen3 VL 32B Reasoning | Alibaba | 78.4 | 1 | 2026-08-23 |
| 15 | Qwen2-VL-72B-Instruct | Alibaba | 77.8 | 2 | 2026-08-24 |
| 16 | Qwen3 VL 30B A3B Reasoning | Alibaba | 77.4 | 1 | 2026-08-23 |
| 17 | Claude Opus 4.5 | Anthropic | 77 | 1 | 2026-08-24 |
| 18 | GPT-4o | OpenAI | 75.4 | 1 | 2026-08-24 |
| 19 | Claude Opus 4.6 | Anthropic | 73.9 | 1 | 2026-08-24 |
| 20 | Qwen3 VL 30B A3B Instruct | Alibaba | 73.7 | 1 | 2026-08-23 |
| 21 | Qwen3 VL Thinking (8B) | Alibaba | 73.5 | 1 | 2026-08-23 |
| 22 | Qwen3 VL 4B (Reasoning) | Alibaba | 73.2 | 1 | 2026-08-23 |
| 23 | LFM2.5-VL-3B | Liquid AI | 73.1 | 3 | 2026-08-23 |
| 24 | Gemma 4 31B | 72.3 | 2 | 2026-08-24 | |
| 25 | Gemma 4 26B A4B | 72.2 | 1 | 2026-08-24 | |
| 26 | Qwen3 VL 8B Instruct | Alibaba | 71.5 | 1 | 2026-08-23 |
| 27 | LFM2-VL-3B | Liquid AI | 71.4 | 2 | 2026-08-22 |
| 28 | LFM2-VL-3B (3.1B) | Liquid AI | 71.1 | 1 | 2026-08-12 |
| 29 | Qwen3 VL 4B Instruct | Alibaba | 70.9 | 1 | 2026-08-23 |
| 30 | Qwen2.5 Omni 7B | Alibaba | 70.3 | 1 | 2026-08-23 |
| 31 | Claude Sonnet 4.5 | Anthropic | 70.3 | 1 | 2026-08-24 |
| 32 | LFM2-VL-1.6B | Liquid AI | 65.8 | 1 | 2026-08-09 |
| 33 | Qwen2.5 VL 3B | Alibaba | 65.2 | 1 | 2026-08-09 |
| 34 | InternVL3-2B | OpenGVLab | 65.1 | 1 | 2026-08-09 |
| 35 | LFM2.5-VL-1.6B | Liquid AI | 64.8 | 1 | 2026-08-09 |
| 36 | North-Micro-Vision-Instruct | Cohere | 62.2 | 1 | 2026-08-23 |
| 37 | InternVL3_5-2B | OpenGVLab | 60.8 | 1 | 2026-08-09 |
| 38 | Claude 3.5 Sonnet | Anthropic | 60.1 | 1 | 2026-08-24 |
| 39 | LFM2.5-VL-450M-Extract | Liquid AI | 58.4 | 1 | 2026-08-09 |
| 40 | InternVL3.5-1B | OpenGVLab | 57.1 | 1 | 2026-08-09 |
| 41 | Gemma 4 E2B | 56.2 | 1 | 2026-08-12 | |
| 42 | LFM2-VL-450M | Liquid AI | 52 | 1 | 2026-08-09 |
Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.