VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Sonnet 4 vs Qwen3.6 35B A3B

AnthropicvsAlibaba29 shared benchmarks1118 head-to-head
BenchmarkClaude Sonnet 4Qwen3.6 35B A3B
AA Agentic Index39.221.6
AA Intelligence29.832.1
AA-LCR69.766.7
AA-Omniscience0.2-22.2
Artificial Analysis Coding Index37.641.9
browsecomp12.248.7
critpt1.10.3
gdpval31.227.8
GPQA Diamond7886
HLE10.722.2
HMMT 202515.989.1
IFBench5564.4
LiveCodeBench v648.580.4
mmlu_redux93.693.3
MMLU-Pro8485.6
MMMU74.481.7
MMMU-Pro62.475.3
OmniScience Accuracy22.718.8
OmniScience Non-Hallucination70.949.5
scicode4035.8
supergpqa55.764.7
SWE-bench Multilingual56.967.2
SWE-bench Pro42.749.5
SWE-bench Verified80.273.4
TauBench V3 - Banking16.79.3
Terminal-Bench 2.136.344.9
Terminal-Bench Hard31.134.8
τ²-Bench Telecom (AA run)64.695.3
τ³-Bench13.867.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.