VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Pro vs GPT-5

GooglevsOpenAI60 shared benchmarks519 head-to-head
BenchmarkGemini 3 ProGPT-5
AA Agentic Index5249.7
AA Intelligence40.635.3
AA-LCR7376.3
AA-Omniscience15.3-8.7
AIME 202510095
AIME25 no tools9694.6
arc_agi_17556.2
ARC-AGI-2547.5
arena_vision12901212
Arena-Hard (Creative Writing)93.692.2
Arena-Hard (Hard Prompt)72.671.9
Artificial Analysis Coding Index46.538.9
browsecomp59.254.9
browsecomp_zh66.865
coding_arena_elo14381419
critpt9.15.7
Fortress41.717
frontiermath_tier_418.812.5
gdpval34.232.5
GPQA Diamond91.987.3
HLE45.828.5
HLE (with tools)45.835.2
hmmt_feb_202597.588.3
hmmt_nov_202593.389.2
IFBench70.473.1
imo_answer_bench83.376
LiveCodeBench9285
LiveCodeBench v690.787
matharena_visual_math_overall84.278.8
metr_hcast71.368.4
metr_re_bench3540
metr_swaa99.5100
MMLU-Pro90.187.5
MMMU-Pro8178.4
Multi-SWE-Bench42.739.3
multichallenge65.771.1
MultiNRC5952.1
ocrbench_v263.455.5
OJ-Bench (cpp)68.556.2
OmniScience Accuracy55.840.3
OmniScience Non-Hallucination1021
scicode56.143
SEAL VISTA51.549.7
Seal-045.551.4
simplebench76.456.7
simpleqa_verified72.950.6
swe_bench_bash74.265
SWE-bench Multilingual68.755.3
SWE-bench Pro43.341.8
SWE-bench Verified7874.9
Terminal-Bench 2.054.235.2
Terminal-Bench Hard56.937.9
vectara_answer_rate99.499.9
vectara_avg_summary_length101.9162.7
vectara_factual_consistency86.485.3
vectara_hallucination_rate13.614.7
VideoMMMU87.684.6
VisualToolBench26.918.7
τ²-Bench9885
τ²-Bench Telecom (AA run)9886.5

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.