VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 2.5 Pro vs GPT-5

GooglevsOpenAI57 shared benchmarks947 head-to-head
BenchmarkGemini 2.5 ProGPT-5
AA Agentic Index7.249.7
AA Intelligence2735.3
AA-LCR6676.3
AA-Omniscience-14.3-8.7
aider_polyglot82.288
AIME 202588.395
AIR-Bench 202473.687.7
arc_agi_14156.2
ARC-AGI-24.97.5
arena_vision12461212
ArtifactsBench57.773
Artificial Analysis Coding Index46.738.9
browsecomp9.954.9
browsecomp_zh32.265
coding_arena_elo12241419
critpt2.65.7
FinSearchComp-global42.663.9
Fortress54.917
frontiermath_tier_44.212.5
GAIA (text only)60.276.4
gdpval8.532.5
GPQA Diamond84.487.3
harmbench65.470
HLE22.528.5
HLE (with tools)28.435.2
HMMT 202565.793.3
hmmt_feb_202582.588.3
hmmt_nov_20258089.2
IFBench4973.1
imo_202531.638.1
LiveCodeBench82.785
matharena_visual_math_overall77.278.8
MMLU-Pro8687.5
MMMU83.984.2
MMMU-Pro74.978.4
multichallenge53.671.1
ocrbench_v259.355.5
OmniScience Accuracy3940.3
OmniScience Non-Hallucination12.621
scicode4343
SEAL VISTA50.849.7
simplebench62.456.7
simpleqa_verified5650.6
swe_bench_bash53.665
SWE-bench Verified67.274.9
TauBench V3 - Banking9.722.1
Terminal-Bench25.343.8
Terminal-Bench 2.128.535.2
Terminal-Bench Hard26.537.9
vectara_answer_rate99.199.9
vectara_avg_summary_length106.4162.7
vectara_factual_consistency9385.3
vectara_hallucination_rate714.7
xbench_deepsearch5677.8
τ²-Bench5485
τ²-Bench Telecom (AA run)54.186.5
τ³-Bench9.319.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.