VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

MATH Lvl 5 (HF Open LLM)

23 models tracked

MATH Level-5-only (hardest tier, 4-shot, Minerva-style) from the HF Open LLM Leaderboard v2. Baseline 0 → values are already raw accuracy. A different filter than standard MATH → unpooled.

#ModelVendorBest scoreRunsLast seen
1Qwen 14B B100Alibaba54.412026-07-04
2Marco-o1AIDC-AI37.512026-07-04
3Yi 1.5 34B Chat01.AI27.712026-07-04
4NuminaMath-7B-CoTAI-MO2712026-07-04
5Llama 3.1 8B SquarerootMeta26.612026-07-04
6Qwen2.5 7B Test NovelistAlibaba23.512026-07-04
7Yi 1.5 9B Chat01.AI22.612026-07-04
8Yi 1.5 34B Chat 16K01.AI21.412026-07-04
9Yi 1.5 9B Chat 16K01.AI17.812026-07-04
10Yi 1.5 6B Chat01.AI16.212026-07-04
11NuminaMath-7B-TIRAI-MO16.112026-07-04
12Yi 1.5 34B 32K01.AI15.412026-07-04
13Yi 1.5 34B01.AI15.312026-07-04
14Qwen2.5 1.5B Continuous LearntAlibaba14.712026-07-04
15smartllama3.1-8B-001Meta1312026-07-04
16Yi 1.5 9B01.AI11.412026-07-04
17Yi 1.5 9B 32K01.AI10.812026-07-04
18Yi 1.5 6B01.AI6.612026-07-04
19Yi 9B 200K01.AI6.612026-07-04
20Llama Squared 8BMeta5.712026-07-04
21Yi 9B01.AI5.612026-07-04
22Yi Coder 9B Chat01.AI412026-07-04
23Llama 3 Instruct 8BMeta3.912026-07-04

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.