LiveCodeBench, Medium difficulty subset — Difficulty-tier subset, never merge with overall/easy/hard scores.
| # | Model | Vendor | Best score | Runs | Last seen |
|---|---|---|---|---|---|
| 1 | o4-mini | OpenAI | 92.2 | 3 | 2026-05-03 |
| 2 | Gemini 2.5 Pro Preview 06.05 (32k think) | 92.2 | 1 | 2026-05-30 | |
| 3 | DeepSeek-R1 | DeepSeek | 90.9 | 1 | 2026-05-03 |
| 4 | Gemini 2.5 Pro | 90.6 | 2 | 2026-05-03 | |
| 5 | o3 | OpenAI | 89.8 | 1 | 2026-05-03 |
| 6 | Qwen3 235B A22B | Alibaba | 88.8 | 1 | 2026-05-03 |
| 7 | EXAONE 4.0 32B | LG AI | 88.3 | 1 | 2026-05-03 |
| 8 | OpenReasoning-Nemotron-32B | NVIDIA | 87.5 | 1 | 2026-05-03 |
| 9 | o3-mini | OpenAI | 87.5 | 3 | 2026-06-18 |
| 10 | Grok 3 Mini Reasoning | SpaceXAI | 85.9 | 1 | 2026-05-03 |
| 11 | OpenCodeReasoning-Nemotron-1.1-32B | NVIDIA | 85.7 | 1 | 2026-05-03 |
| 12 | Gemini 2.5 Flash | 82.5 | 3 | 2026-06-20 | |
| 13 | Claude 4 Opus | Anthropic | 80.4 | 2 | 2026-05-29 |
| 14 | Claude Sonnet 4 | Anthropic | 76 | 2 | 2026-05-15 |
| 15 | DeepSeek-V3 | DeepSeek | 53.5 | 1 | 2026-05-03 |
| 16 | GPT-4o | OpenAI | 32.1 | 1 | 2026-05-03 |
| 17 | GPT-4 Turbo | OpenAI | 30.7 | 1 | 2026-05-03 |
| 18 | GPT-4o mini | OpenAI | 25.2 | 1 | 2026-05-03 |
| 19 | Claude 3 Haiku | Anthropic | 9 | 1 | 2026-05-03 |
Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.