VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.6 Plus vs Qwen3.7 Max

AlibabavsAlibaba55 shared benchmarks450 head-to-head
BenchmarkQwen3.6 PlusQwen3.7 Max
AA Agentic Index2930.9
AA Intelligence40.546.7
AA-LCR72.374.7
AA-Omniscience2.613.5
aime_202695.397
arena_elo14441474
arena_text_factuality14381479
Artificial Analysis Coding Index54.566
Claw Eval (pass@3)58.765.2
coding_arena_elo14601517
critpt2.913.4
Finance Agent v240.948.4
gdpval3238.5
GPQA Diamond90.492.4
HLE28.841.4
HLE (with tools)50.653.5
hmmt_feb_202687.897.1
hmmt_nov_202594.695
IFBench75.280.5
ifeval94.394.3
imo_answer_bench83.890
include85.186.2
livebench70.874.3
livebench_agentic_coding41.443.6
livebench_coding78.274.2
livebench_data_analysis69.971.8
livebench_instruction_following58.374
livebench_language7579.7
livebench_math83.785.3
livebench_reasoning75.883.3
LiveCodeBench v687.191.6
longbench_v26265.3
MCP Atlas74.176.4
mcpmark48.260.8
mmlu_prox84.787
mmlu_redux94.595
MMLU-Pro88.589.6
mmmlu89.590.3
nl2repo37.947.2
OmniScience Accuracy26.431.1
OmniScience Non-Hallucination6874.4
scicode40.753.5
simpleqa_verified49.158.5
supergpqa71.673.6
SWE-bench Multilingual73.878.3
SWE-bench Pro56.660.6
SWE-bench Verified78.880.4
TauBench V3 - Banking20.811.8
Terminal-Bench 2.061.669.7
Terminal-Bench 2.161.475
Terminal-Bench Hard43.950.8
VITA-Bench44.347.9
WideSearch74.375.2
τ²-Bench Telecom (AA run)97.794.7
τ³-Bench70.710.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.