VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-4o vs Qwen3.6 27B

OpenAIvsAlibaba33 shared benchmarks528 head-to-head
BenchmarkGPT-4oQwen3.6 27B
AA Agentic Index9.727.5
AA Intelligence11.237.7
AA-LCR5573.3
AA-Omniscience-10.5-20
Artificial Analysis Coding Index24.253.7
C-Eval7691.4
critpt01.1
ERQA35.262.5
gdpval032
GPQA Diamond70.187.8
HLE5.324
humaneval90.678.2
IFBench3669.1
LiveCodeBench v630.983.9
mathvision30.485.1
MathVista63.887.4
mmlu_redux8893.5
MMLU-Pro74.786.2
MMMU72.282.9
MMMU-Pro59.975.8
MMStar63.981.4
OCRBench80689.4
OmniScience Accuracy23.719.6
OmniScience Non-Hallucination62.150.7
OSWorld-Verified563.9
RealWorldQA75.484.1
scicode33.439.8
simpleqa39.495.7
supergpqa42.466
SWE-bench Verified38.877.2
Terminal-Bench Hard8.334.8
VideoMMMU61.284.4
τ²-Bench Telecom (AA run)28.994.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.