VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.5 35B A3B vs Qwen3.7 Plus Preview

AlibabavsAlibaba54 shared benchmarks450 head-to-head
BenchmarkQwen3.5 35B A3BQwen3.7 Plus Preview
AA Agentic Index44.120.8
AA Intelligence29.939.4
AA-LCR68.369
AA-Omniscience-48.12.4
Artificial Analysis Coding Index3755.9
baby_vision38.470.4
bfcl_v467.372.9
charxiv_rq77.585.9
Claw Eval (pass@3)5162.7
critpt0.99.1
DeepPlanning22.862.3
ERQA64.869.8
gdpval20.322.2
GPQA Diamond84.590.3
HLE47.435.6
hmmt_feb_202681.892.9
IFBench72.579.1
ifeval91.994.6
imo_answer_bench76.886
include79.783
LiveCodeBench v674.689.6
LVBench71.476.2
mathvision83.990.3
MCP Atlas62.473.2
mcpmark2758.7
MLVU85.687.4
mmlu_prox8185.4
mmlu_redux93.394.5
MMLU-Pro85.388.5
mmmlu85.289
MMMU-Pro75.180.5
nl2repo20.541.1
ocrbench_v265.367.1
OmniDocBench 1.589.391.4
OmniScience Accuracy20.122.5
OmniScience Non-Hallucination14.674.5
OSWorld-Verified54.573.3
QwenClawBench47.761.8
RealWorldQA84.186.9
scicode37.751.3
screenspot_pro_no_tools68.679
SimpleVQA58.30.8
supergpqa63.471.4
SWE-bench Multilingual60.375.8
SWE-bench Pro44.657.6
SWE-bench Verified7077.7
TauBench V3 - Banking4.917.9
Terminal-Bench 2.040.570.3
Terminal-Bench 2.140.861
Terminal-Bench Hard26.547
VideoMMMU80.485.4
VITA-Bench31.945.6
τ²-Bench Telecom (AA run)89.293
τ³-Bench68.917.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.