VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-4o vs Qwen3.5 35B A3B

OpenAIvsAlibaba45 shared benchmarks1134 head-to-head
BenchmarkGPT-4oQwen3.5 35B A3B
AA Agentic Index9.744.1
AA Intelligence11.229.9
AA-LCR5568.3
AA-Omniscience-10.5-48.1
AI2D94.292.6
Artificial Analysis Coding Index24.237
C-Eval7690.2
critpt00.9
ERQA35.264.8
gdpval020.3
GPQA Diamond70.184.5
GSM8K95.690.1
HLE5.347.4
humaneval90.666.5
IFBench3672.5
ifeval84.391.9
LiveCodeBench v630.974.6
longbench_v248.159
mathvision30.483.9
MathVista63.886.2
mmlu88.181.1
mmlu_prox61.181
mmlu_redux8893.3
MMLU-Pro74.785.3
mmmlu81.485.2
MMMU72.281.4
MMMU-Pro59.975.1
MMStar63.981.9
multichallenge40.360
OCRBench80691
OmniScience Accuracy23.720.1
OmniScience Non-Hallucination62.114.6
OpenBookQA96.844.2
OSWorld-Verified554.5
RealWorldQA75.484.1
scicode33.437.7
supergpqa42.463.4
SWE-bench Verified38.870
Terminal-Bench Hard8.326.5
vectara_answer_rate93.899.8
vectara_avg_summary_length86.694.9
vectara_factual_consistency90.489.5
vectara_hallucination_rate9.610.5
VideoMMMU61.280.4
τ²-Bench Telecom (AA run)28.989.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.