VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.6 Plus vs Qwen3.7 Plus Preview

AlibabavsAlibaba52 shared benchmarks1733 head-to-head
BenchmarkQwen3.6 PlusQwen3.7 Plus Preview
AA Agentic Index2920.8
AA Intelligence40.539.4
AA-LCR72.369
AA-Omniscience2.62.4
arena_elo14441458
arena_text_factuality14381454
Artificial Analysis Coding Index54.555.9
Claw Eval (pass@3)58.762.7
critpt2.99.1
DeepPlanning41.562.3
ERQA65.769.8
Finance Agent v240.938.2
gdpval3222.2
GPQA Diamond90.490.3
HLE28.835.6
hmmt_feb_202687.892.9
IFBench75.279.1
ifeval94.394.6
imo_answer_bench83.886
include85.183
LiveCodeBench v687.189.6
mathvision8890.3
MCP Atlas74.173.2
mcpmark48.258.7
MLVU86.787.4
mmlu_prox84.785.4
mmlu_redux94.594.5
MMLU-Pro88.588.5
mmmlu89.589
MMMU-Pro78.880.5
nl2repo37.941.1
OmniDocBench 1.591.291.4
OmniScience Accuracy26.422.5
OmniScience Non-Hallucination6874.5
OSWorld-Verified62.573.3
RealWorldQA85.486.9
scicode40.751.3
screenspot_pro_no_tools68.279
SimpleVQA0.70.8
supergpqa71.671.4
SWE-bench Multilingual73.875.8
SWE-bench Pro56.657.6
SWE-bench Verified78.877.7
TauBench V3 - Banking20.817.9
Terminal-Bench 2.061.670.3
Terminal-Bench 2.161.461
Terminal-Bench Hard43.947
Video-MME84.288
VideoMMMU8485.4
VITA-Bench44.345.6
τ²-Bench Telecom (AA run)97.793
τ³-Bench70.717.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.