VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 2.5 Pro vs GPT-5.1

GooglevsOpenAI46 shared benchmarks1036 head-to-head
BenchmarkGemini 2.5 ProGPT-5.1
AA Agentic Index7.232.2
AA Intelligence2737.5
AA-LCR6676.7
AA-Omniscience-14.35.4
AIME 202588.394.2
arc_agi_14172.8
ARC-AGI-24.917.6
arena_elo14461439
arena_text_factuality14621445
arena_vision12461250
Artificial Analysis Coding Index46.749.4
browsecomp9.950.8
coding_arena_elo12241421
critpt2.64.9
Fortress54.925.7
frontiermath_tier_44.212.5
gdpval8.525
GPQA Diamond84.488.1
HLE22.528.5
HLE (with tools)28.442.7
hmmt_feb_202582.596.3
hmmt_nov_20258091.7
IFBench4972.9
matharena_visual_math_overall77.276.9
MMLU-Pro8687
MMMU83.985.4
MMMU-Pro74.975.5
multichallenge53.663.4
OmniScience Accuracy3937.7
OmniScience Non-Hallucination12.648.1
scicode4343.3
SEAL VISTA50.843.8
simplebench62.453.2
simpleqa_verified5648.9
swe_bench_bash53.666
SWE-bench Verified67.276.3
TauBench V3 - Banking9.715.9
Terminal-Bench 2.128.552.4
Terminal-Bench Hard26.545.5
vectara_answer_rate99.1100
vectara_avg_summary_length106.4254.4
vectara_factual_consistency9389.1
vectara_hallucination_rate712.1
τ²-Bench5482.7
τ²-Bench Telecom (AA run)54.181.9
τ³-Bench9.314

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.