VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

frontiermath_tier_4

51 models tracked

FrontierMath — Tier 4 (hardest) — Epoch AI's FrontierMath, Tier 4 difficulty split.

#ModelVendorBest scoreRunsLast seen
1GPT-5.5 ProOpenAI39.612026-05-20
2GPT-5.4 ProOpenAI37.512026-05-20
3GPT-5.5OpenAI35.412026-05-20
4GPT-5.2 ProOpenAI31.312026-05-20
5Claude Opus 4.8Anthropic31.312026-06-13
6GPT-5.4OpenAI27.112026-05-20
7Claude Opus 4.7Anthropic22.912026-05-20
8Claude Opus 4.6Anthropic22.922026-05-20
9GPT-5.2OpenAI18.842026-05-20
10Gemini 3 ProGoogle18.812026-05-20
11Gemini 3.1 ProGoogle16.712026-05-20
12Muse SparkMeta14.612026-05-20
13GPT-5 ProOpenAI14.612026-05-20
14Gemini 3.5 FlashGoogle14.612026-05-29
15Kimi K2.6Moonshot14.612026-05-20
16GPT-5OpenAI12.512026-05-20
17GPT-5.1OpenAI12.532026-06-20
18GLM-5.1Z.ai12.512026-05-20
19Gemini 2.5 Deep ThinkGoogle10.412026-05-20
20Qwen3.6 PlusAlibaba8.312026-05-20
21Claude Sonnet 4.6Anthropic8.312026-06-23
22o4-miniOpenAI6.322026-05-20
23GPT-5.4 nanoOpenAI6.312026-05-20
24GPT-5 miniOpenAI6.322026-05-20
25Kimi K2.5Moonshot4.212026-05-20
26Qwen3.6 Max PreviewAlibaba4.212026-06-02
27Claude Sonnet 4.5Anthropic4.222026-05-30
28Claude 4 OpusAnthropic4.212026-05-20
29Gemini 2.5 FlashGoogle4.212026-05-20
30Gemini 2.5 ProGoogle4.212026-05-20
31o3-miniOpenAI4.212026-05-20
32Claude Opus 4.5Anthropic4.212026-05-20
33Gemini 3 Flash PreviewGoogle4.212026-05-20
34Claude Opus 4.1Anthropic4.212026-05-20
35GLM-4.6Z.ai2.112026-05-20
36GLM-5Z.ai2.112026-05-20
37DeepSeek-V3.2DeepSeek2.112026-05-20
38Grok 4SpaceXAI2.112026-05-20
39GPT-5 nanoOpenAI2.122026-05-20
40Grok 4 Heavy (web app)SpaceXAI2.112026-05-20
41o3OpenAI2.112026-05-20
42GPT-5.4 miniOpenAI2.112026-05-20
43Claude Haiku 4.5Anthropic2.112026-05-20
44Grok 3SpaceXAI022026-06-19
45Kimi K2 (Reasoning)Moonshot012026-05-20
46GLM-4.7Z.ai012026-05-20
47Qwen 3.6 FlashAlibaba012026-05-20
48Qwen3.5 FlashAlibaba012026-08-07
49Claude 3.5 SonnetAnthropic022026-05-20
50GPT-4.1OpenAI012026-05-20
51Claude Sonnet 4Anthropic012026-05-20

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.