VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs Qwen3.5 35B A3B

GooglevsAlibaba55 shared benchmarks523 head-to-head
BenchmarkGemini 3.1 ProQwen3.5 35B A3B
AA Agentic Index2344.1
AA Intelligence47.729.9
AA-LCR7968.3
AA-Omniscience32.9-48.1
AgentWorldBench - Android61.453.2
AgentWorldBench - MCP59.157.9
AgentWorldBench - OS66.956.3
AgentWorldBench - Overall54.647.7
AgentWorldBench - Search30.226
AgentWorldBench - SWE59.147.6
AgentWorldBench - Terminal52.546.1
AgentWorldBench - Web52.847.1
aime_202698.393.3
Artificial Analysis Coding Index68.837
baby_vision51.638.4
browsecomp85.961
charxiv_rq89.977.5
coding_arena_elo14471250
critpt17.70.9
gdpval23.320.3
GPQA Diamond94.384.5
HLE51.447.4
hmmt_feb_202694.781.8
hmmt_nov_202594.889.2
IFBench77.172.5
imo_answer_bench9176.8
itbenchSre30.321.5
LiveCodeBench v691.774.6
mathvision89.883.9
MCP Atlas78.262.4
mcpmark55.927
mmlu92.681.1
MMLU-Pro9185.3
mmmlu92.685.2
MMMU-Pro8375.1
multichallenge71.460
nl2repo33.420.5
OmniScience Accuracy55.320.1
OmniScience Non-Hallucination50.114.6
OSWorld-Verified76.254.5
scicode5937.7
SWE-bench Multilingual76.960.3
SWE-bench Pro54.244.6
SWE-bench Verified80.670
TauBench V3 - Banking21.44.9
Terminal-Bench 2.068.540.5
Terminal-Bench 2.17440.8
Terminal-Bench Hard68.526.5
tool_decathlon48.828.7
vectara_answer_rate99.499.8
vectara_avg_summary_length107.794.9
vectara_factual_consistency89.689.5
vectara_hallucination_rate10.410.5
τ²-Bench Telecom (AA run)99.389.2
τ³-Bench67.168.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.