VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Pro vs GPT-4o

GooglevsOpenAI46 shared benchmarks415 head-to-head
BenchmarkGemini 3 ProGPT-4o
AA Agentic Index529.7
AA Intelligence40.611.2
AA-LCR7355
AA-Omniscience15.3-10.5
AIME 202510011.7
arc_agi_1754.5
ARC-AGI-2540
arena_vision12901162
Artificial Analysis Coding Index46.524.2
critpt9.10
Fortress41.747.2
gdpval34.20
GPQA Diamond91.970.1
HLE45.85.3
IFBench70.436
LiveCodeBench9238.3
LiveCodeBench v690.730.9
longbench_v268.248.1
mathvision86.130.4
MathVista89.863.8
metr_hcast71.325
metr_re_bench350
metr_swaa99.599.2
MMLU-Pro90.174.7
mmmlu91.881.4
MMMU-Pro8159.9
multichallenge65.740.3
MultiNRC5912.4
OCRBench90.3806
OmniScience Accuracy55.823.7
OmniScience Non-Hallucination1062.1
PropensityBench52.946.1
scicode56.133.4
SEAL VISTA51.534.9
simplebench76.417.8
simpleqa72.139.4
swe_bench_bash74.221.6
SWE-bench Verified7838.8
Terminal-Bench Hard56.98.3
vectara_answer_rate99.493.8
vectara_avg_summary_length101.986.6
vectara_factual_consistency86.490.4
vectara_hallucination_rate13.69.6
Video-MME88.477.2
VideoMMMU87.661.2
τ²-Bench Telecom (AA run)9828.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.