VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.6 vs Qwen3.5 35B A3B

AnthropicvsAlibaba57 shared benchmarks4214 head-to-head
BenchmarkClaude Opus 4.6Qwen3.5 35B A3B
AA Agentic Index67.644.1
AA Intelligence44.929.9
AA-LCR74.368.3
AA-Omniscience13.7-48.1
AgentWorldBench - Android61.753.2
AgentWorldBench - MCP69.957.9
AgentWorldBench - OS70.256.3
AgentWorldBench - Overall57.847.7
AgentWorldBench - Search29.326
AgentWorldBench - SWE64.547.6
AgentWorldBench - Terminal57.546.1
AgentWorldBench - Web51.447.1
aime_202696.793.3
Artificial Analysis Coding Index48.137
baby_vision14.838.4
browsecomp86.861
charxiv_rq69.177.5
coding_arena_elo15451250
critpt12.60.9
ERQA40.864.8
gdpval55.920.3
GPQA Diamond91.384.5
GSM8K0.690.1
HLE53.147.4
hmmt_feb_202696.281.8
hmmt_nov_202596.389.2
IFBench62.572.5
imo_answer_bench75.376.8
LiveCodeBench v688.874.6
mathvision71.283.9
MCP Atlas76.862.4
mcpmark56.727
MMLU-Pro89.185.3
mmmlu91.185.2
MMMU-Pro77.375.1
multichallenge5660
nl2repo49.820.5
ocrbench_v248.465.3
OmniDocBench 1.586.689.3
OmniScience Accuracy4720.1
OmniScience Non-Hallucination37.214.6
OSWorld-Verified72.754.5
RealWorldQA73.984.1
scicode5237.7
screenspot_pro_no_tools57.768.6
SWE-bench Multilingual77.860.3
SWE-bench Pro57.344.6
SWE-bench Verified80.870
Terminal-Bench 2.065.440.5
Terminal-Bench Hard65.426.5
tool_decathlon47.228.7
vectara_answer_rate99.899.8
vectara_avg_summary_length137.694.9
vectara_factual_consistency87.889.5
vectara_hallucination_rate12.210.5
τ²-Bench Telecom (AA run)99.389.2
τ³-Bench72.468.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.