VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-4o vs Qwen3.6 Plus

OpenAIvsAlibaba35 shared benchmarks035 head-to-head
BenchmarkGPT-4oQwen3.6 Plus
AA Agentic Index9.729
AA Intelligence11.240.5
AA-LCR5572.3
AA-Omniscience-10.52.6
AI2D94.294.4
Artificial Analysis Coding Index24.254.5
C-Eval7693.3
critpt02.9
ERQA35.265.7
gdpval032
GPQA Diamond70.190.4
HLE5.328.8
IFBench3675.2
ifeval84.394.3
LiveCodeBench v630.987.1
longbench_v248.162
mathvision30.488
mmlu_prox61.184.7
mmlu_redux8894.5
MMLU-Pro74.788.5
mmmlu81.489.5
MMMU72.286
MMMU-Pro59.978.8
MMStar63.983.3
OmniScience Accuracy23.726.4
OmniScience Non-Hallucination62.168
OSWorld-Verified562.5
RealWorldQA75.485.4
scicode33.440.7
supergpqa42.471.6
SWE-bench Verified38.878.8
Terminal-Bench Hard8.343.9
Video-MME77.284.2
VideoMMMU61.284
τ²-Bench Telecom (AA run)28.997.7

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.