VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 2.5 Pro vs o3

GooglevsOpenAI46 shared benchmarks2224 head-to-head
BenchmarkGemini 2.5 Proo3
AA Agentic Index7.236.1
AA Intelligence2731.1
AA-LCR6673.3
AA-Omniscience-14.3-15.3
aider_polyglot82.281.3
AIME 202588.389.2
AIR-Bench 202473.684.5
anthropic_red_team99.598.3
arc_agi_14160.8
ARC-AGI-24.96.5
arena_vision12461217
Artificial Analysis Coding Index46.738.4
bbq96.497.9
browsecomp9.949.7
critpt2.61.1
Fortress54.916
frontiermath_tier_44.22.1
gdpval8.512.8
GPQA Diamond84.483.3
harmbench65.498.4
HLE22.520.3
hmmt_feb_202582.577.5
IFBench4971.4
imo_202531.616.7
LiveCodeBench82.784.7
livecodebench_easy98.899.1
livecodebench_hard59.466
livecodebench_medium90.689.8
MathVista83.986.8
MMLU-Pro8685
MMMU83.982.9
MMMU-Pro74.976.4
multichallenge53.660.4
OmniScience Accuracy3938.6
OmniScience Non-Hallucination12.612.9
PropensityBench7910.5
scicode4341
simple_safety_tests9799
simplebench62.453.1
simpleqa50.849.4
simpleqa_verified5653
swe_bench_bash53.658.4
SWE-bench Verified67.269.1
Terminal-Bench Hard26.537.1
xstest98.797.3
τ²-Bench Telecom (AA run)54.180.7

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.