VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.6 Plus vs Qwen3 VL 4B (Reasoning)

AlibabavsAlibaba33 shared benchmarks330 head-to-head
BenchmarkQwen3.6 PlusQwen3 VL 4B (Reasoning)
AA Agentic Index2914.4
AA Intelligence40.57.7
AA-LCR72.323
AA-Omniscience2.6-68.4
AI2D94.484.9
Artificial Analysis Coding Index54.56.7
critpt2.90
ERQA65.747.3
gdpval3213.8
GPQA Diamond90.464.1
HLE28.84.6
HMMT 202594.653.1
IFBench75.236.6
ifeval94.382.6
include85.164.6
LiveCodeBench v687.151.3
mathvision8860
mmlu_prox84.765
mmlu_redux94.586
MMLU-Pro88.573.6
MMMU-Pro78.857
MMStar83.373.2
OmniScience Accuracy26.412.2
OmniScience Non-Hallucination688.2
OSWorld-Verified62.531.4
RealWorldQA85.473.2
scicode40.717.1
screenspot_pro_no_tools68.249.2
supergpqa71.646.8
Terminal-Bench Hard43.91.5
Video-MME84.259.7
VideoMMMU8469.4
τ²-Bench Telecom (AA run)97.715.5

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.