VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.5 397B A17B vs Qwen3.7 Max

AlibabavsAlibaba47 shared benchmarks542 head-to-head
BenchmarkQwen3.5 397B A17BQwen3.7 Max
AA Agentic Index53.330.9
AA Intelligence34.346.7
AA-LCR72.774.7
AA-Omniscience-30.813.5
aime_202694.297
arena_elo14421474
arena_text_factuality14451479
Artificial Analysis Coding Index48.266
bfcl_v472.975
Claw Eval (pass@3)48.165.2
coding_arena_elo13991517
critpt1.713.4
gdpval35.838.5
GPQA Diamond89.392.4
HLE2941.4
HLE (with tools)48.353.5
hmmt_feb_202687.997.1
hmmt_nov_202592.795
IFBench78.880.5
ifeval92.694.3
imo_answer_bench80.990
include85.686.2
itbenchSre34.142.5
LiveCodeBench v683.691.6
longbench_v263.265.3
mcpmark46.160.8
mmlu_prox84.787
mmlu_redux94.995
MMLU-Pro87.889.6
mmmlu88.590.3
nl2repo32.247.2
OmniScience Accuracy30.831.1
OmniScience Non-Hallucination17.374.4
scicode4253.5
simpleqa_verified2658.5
supergpqa70.473.6
SWE-bench Multilingual69.378.3
SWE-bench Pro50.960.6
SWE-bench Verified76.480.4
TauBench V3 - Banking13.411.8
Terminal-Bench 2.052.569.7
Terminal-Bench 2.151.375
Terminal-Bench Hard40.950.8
VITA-Bench49.747.9
WideSearch7475.2
τ²-Bench Telecom (AA run)95.694.7
τ³-Bench13.410.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.