VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-4o mini vs Qwen2.5 Instruct 72B

OpenAIvsAlibaba26 shared benchmarks521 head-to-head
BenchmarkGPT-4o miniQwen2.5 Instruct 72B
AA Intelligence710
aider_polyglot3.67.6
AIR-Bench 202456.359
anthropic_red_team98.399.6
Artificial Analysis Coding Index11.411.9
bbq88.295.4
DROP79.776.7
Fortress48.156.4
GPQA Diamond42.649.1
GSM8K84.395.8
harmbench84.972.8
HLE4.24.2
humaneval87.286.6
IFBench3136.9
LiveCodeBench35.555.5
MATH80.288.4
mgsm8787.3
mmlu81.886.1
narrativeqa76.874.5
naturalquestions_closedbook38.535.9
OpenBookQA9296.2
scicode22.926.7
simple_safety_tests97.8100
simpleqa9.910.3
SWE-bench Verified8.723.8
xstest9697.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.