VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs Qwen3.5 397B A17B

GooglevsAlibaba57 shared benchmarks4610 head-to-head
BenchmarkGemini 3.1 ProQwen3.5 397B A17B
AA Agentic Index2353.3
AA Intelligence47.734.3
AA-LCR7972.7
AA-Omniscience32.9-30.8
AgentWorldBench - Android61.454.9
AgentWorldBench - MCP59.168.3
AgentWorldBench - OS66.960.9
AgentWorldBench - Overall54.654.7
AgentWorldBench - Search30.230.8
AgentWorldBench - SWE59.164.4
AgentWorldBench - Terminal52.555.3
AgentWorldBench - Web52.848.5
aime_202698.394.2
apexAgents33.515.3
arena_elo14861442
arena_text_factuality14711445
arena_vision12801249
Artificial Analysis Coding Index68.848.2
browsecomp85.969
charxiv_rq89.980.8
coding_arena_elo14471399
critpt17.71.7
gdpval23.335.8
GDPval-AA v2962962
Global-MMLU-Lite92.790
GPQA Diamond94.389.3
HLE51.429
HLE (with tools)51.648.3
hmmt_feb_202694.787.9
hmmt_nov_202594.892.7
IFBench77.178.8
imo_answer_bench9180.9
itbenchSre30.334.1
LiveCodeBench v691.783.6
mcpmark55.946.1
MMLU-Pro9187.8
mmmlu92.688.5
MMMU-Pro8379
multichallenge71.467.6
nl2repo33.432.2
OmniScience Accuracy55.330.8
OmniScience Non-Hallucination50.117.3
scicode5942
simpleqa_verified77.326
strongreject9899.4
SWE-bench Multilingual76.969.3
SWE-bench Pro54.250.9
SWE-bench Verified80.676.4
Tau 3 Banking16.513.4
TauBench V3 - Banking21.413.4
Terminal-Bench 2.068.552.5
Terminal-Bench 2.17451.3
Terminal-Bench Hard68.540.9
toolathlon48.838.3
usamo_202674.436.3
τ²-Bench Telecom (AA run)99.395.6
τ³-Bench67.113.4

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.