ARC-AGI-3 — Newest ARC-AGI iteration (interactive/agentic); distinct version from v1/v2
| # | Model | Vendor | Best score | Runs | Last seen |
|---|---|---|---|---|---|
| 1 | Opus 5 | Anthropic | 30.2 | 4 | 2026-08-23 |
| 2 | GPT-5.6 Sol | OpenAI | 7.8 | 4 | 2026-08-23 |
| 3 | Grok 4.6 | SpaceXAI | 2.1 | 1 | 2026-08-14 |
| 4 | Claude Opus 4.8 | Anthropic | 1.5 | 3 | 2026-07-24 |
| 5 | GPT-5.6 Terra | OpenAI | 0.8 | 2 | 2026-08-23 |
| 6 | Claude Opus 4.6 | Anthropic | 0.5 | 1 | 2026-05-10 |
| 7 | GPT-5.5 | OpenAI | 0.4 | 1 | 2026-05-10 |
| 8 | Gemini 3.1 Pro | 0.4 | 1 | 2026-05-10 | |
| 9 | Grok4.5 | SpaceXAI | 0.3 | 1 | 2026-07-24 |
| 10 | GPT-5.4 | OpenAI | 0.2 | 1 | 2026-05-10 |
| 11 | GPT-5.6 Luna | OpenAI | 0.2 | 2 | 2026-08-23 |
| 12 | Claude Opus 4.7 | Anthropic | 0.2 | 1 | 2026-05-10 |
| 13 | Grok 4.20 (Beta Reasoning) | SpaceXAI | 0.1 | 1 | 2026-05-10 |
Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.