LiveCodeBench, Hard difficulty subset — Difficulty-tier subset, never merge with overall/easy/medium scores.
| # | Model | Vendor | Best score | Runs | Last seen |
|---|---|---|---|---|---|
| 1 | o3 | OpenAI | 66 | 1 | 2026-05-03 |
| 2 | DeepSeek-R1 | DeepSeek | 63.6 | 1 | 2026-05-03 |
| 3 | o4-mini | OpenAI | 62.9 | 3 | 2026-05-03 |
| 4 | Gemini 2.5 Pro Preview 06.05 (32k think) | 62 | 1 | 2026-05-30 | |
| 5 | Gemini 2.5 Pro | 59.4 | 2 | 2026-05-03 | |
| 6 | OpenReasoning-Nemotron-32B | NVIDIA | 57.5 | 1 | 2026-05-03 |
| 7 | EXAONE 4.0 32B | LG AI | 56.3 | 1 | 2026-05-03 |
| 8 | Qwen3 235B A22B | Alibaba | 54 | 1 | 2026-05-03 |
| 9 | OpenCodeReasoning-Nemotron-1.1-32B | NVIDIA | 52.8 | 1 | 2026-05-03 |
| 10 | Grok 3 Mini Reasoning | SpaceXAI | 51.1 | 1 | 2026-05-03 |
| 11 | Gemini 2.5 Flash | 48.3 | 3 | 2026-06-20 | |
| 12 | o3-mini | OpenAI | 47.4 | 3 | 2026-06-18 |
| 13 | Claude 4 Opus | Anthropic | 33.1 | 2 | 2026-05-29 |
| 14 | Claude Sonnet 4 | Anthropic | 32.6 | 2 | 2026-05-15 |
| 15 | DeepSeek-V3 | DeepSeek | 14.2 | 1 | 2026-05-03 |
| 16 | GPT-4o | OpenAI | 4.5 | 1 | 2026-05-03 |
| 17 | GPT-4o mini | OpenAI | 4.3 | 1 | 2026-05-03 |
| 18 | GPT-4 Turbo | OpenAI | 4 | 1 | 2026-05-03 |
| 19 | Claude 3 Haiku | Anthropic | 1.9 | 1 | 2026-05-03 |
Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.