VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen2.5 Instruct 72B vs Qwen3.5 397B A17B

AlibabavsAlibaba21 shared benchmarks120 head-to-head
BenchmarkQwen2.5 Instruct 72BQwen3.5 397B A17B
AA Intelligence1034.3
AA-LCR20.372.7
AA-Omniscience-52.2-30.8
Artificial Analysis Coding Index11.948.2
C-Eval89.293
critpt01.7
GPQA Diamond49.189.3
GSM8K95.866.7
HLE4.229
IFBench36.978.8
ifeval87.292.6
longbench_v239.463.2
mmlu_redux86.894.9
MMLU-Pro71.687.8
mmmlu74.888.5
OmniScience Accuracy17.630.8
OmniScience Non-Hallucination15.317.3
scicode26.742
SWE-bench Verified23.876.4
Terminal-Bench Hard4.540.9
τ²-Bench Telecom (AA run)34.595.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.