VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs GPT-5.1

GooglevsOpenAI45 shared benchmarks414 head-to-head
BenchmarkGemini 3.1 ProGPT-5.1
AA Agentic Index2332.2
AA Intelligence47.737.5
AA-LCR7976.7
AA-Omniscience32.95.4
arc_agi_19872.8
ARC-AGI-277.117.6
arena_elo14861439
arena_text_factuality14711445
arena_vision12801250
Artificial Analysis Coding Index68.849.4
browsecomp85.950.8
coding_arena_elo14471421
critpt17.74.9
Fortress29.825.7
frontiermath_tier_416.712.5
gdpval23.325
GPQA Diamond94.388.1
HLE51.428.5
HLE (with tools)51.642.7
hmmt_nov_202594.891.7
IFBench77.172.9
LiveCodeBench v691.787
matharena_visual_math_overall89.476.9
MCP Atlas78.250.1
MMLU-Pro9187
mmmlu92.691
MMMU-Pro8375.5
multichallenge71.463.4
MultiNRC64.749
OmniScience Accuracy55.337.7
OmniScience Non-Hallucination50.148.1
scicode5943.3
simplebench79.653.2
simpleqa_verified77.348.9
SWE-bench Verified80.676.3
TauBench V3 - Banking21.415.9
Terminal-Bench 2.068.547.6
Terminal-Bench 2.17452.4
Terminal-Bench Hard68.545.5
vectara_answer_rate99.4100
vectara_avg_summary_length107.7254.4
vectara_factual_consistency89.689.1
vectara_hallucination_rate10.412.1
τ²-Bench Telecom (AA run)99.381.9
τ³-Bench67.114

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.