VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs GPT-5

GooglevsOpenAI46 shared benchmarks415 head-to-head
BenchmarkGemini 3.1 ProGPT-5
AA Agentic Index2349.7
AA Intelligence47.735.3
AA-LCR7976.3
AA-Omniscience32.9-8.7
arc_agi_19856.2
ARC-AGI-277.17.5
arena_vision12801212
Artificial Analysis Coding Index68.838.9
browsecomp85.954.9
coding_arena_elo14471419
critpt17.75.7
Fortress29.817
frontiermath_tier_416.712.5
gdpval23.332.5
GPQA Diamond94.387.3
HLE51.428.5
HLE (with tools)51.635.2
hmmt_nov_202594.889.2
IFBench77.173.1
imo_answer_bench9176
LiveCodeBench91.785
LiveCodeBench v691.787
matharena_visual_math_overall89.478.8
MMLU-Pro9187.5
MMMU-Pro8378.4
multichallenge71.471.1
MultiNRC64.752.1
OmniScience Accuracy55.340.3
OmniScience Non-Hallucination50.121
scicode5943
simplebench79.656.7
simpleqa_verified77.350.6
SWE-bench Multilingual76.955.3
SWE-bench Pro54.241.8
SWE-bench Verified80.674.9
TauBench V3 - Banking21.422.1
Terminal-Bench 2.068.535.2
Terminal-Bench 2.17435.2
Terminal-Bench Hard68.537.9
vectara_answer_rate99.499.9
vectara_avg_summary_length107.7162.7
vectara_factual_consistency89.685.3
vectara_hallucination_rate10.414.7
VisualToolBench2918.7
τ²-Bench Telecom (AA run)99.386.5
τ³-Bench67.119.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.