VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Pro vs GPT-5.2

GooglevsOpenAI88 shared benchmarks4046 head-to-head
BenchmarkGemini 3 ProGPT-5.2
AA Agentic Index5260.2
AA Intelligence40.643.3
AA-LCR7379.3
AA-Omniscience15.30.3
AIME 2025100100
aime_202691.798.3
AIME25 no tools9698
apexAgents18.423
arc_agi_17586.2
ARC-AGI-25452.9
arena_elo14851437
arena_text_factuality14811442
arena_vision12901245
Artificial Analysis Coding Index46.548.7
browsecomp59.265.8
BrowseComp (context management)67.670
browsecomp_with_context_manager59.265.8
browsecomp_zh66.876.1
charxiv_rq81.482.1
coding_arena_elo14381418
critpt9.111.6
deepsearchqa_f163.271.3
Fortress41.717.5
frontiermath_tier_418.818.8
gdpval34.248.3
GDPval-AA (Elo)11951462
GPQA Diamond91.992.4
HLE45.845.5
HLE (with tools)45.845.5
hmmt_feb_202597.5100
hmmt_feb_202686.497
hmmt_nov_202593.399.2
IFBench70.475.4
imo_answer_bench83.386.3
InfoVQA (val)57.284
livebench73.474.8
LiveCodeBench9289
LiveCodeBench Pro (Elo)24392393
longbench_v268.254.5
LongVideoBench77.776.5
matharena_visual_math_overall84.286.5
mathvision86.183
MathVista89.882.8
MCP Atlas70.368
metr_hcast71.377
metr_re_bench3535
metr_swaa99.599.6
MMLU-Pro90.187
mmmlu91.889.6
MMMU-Pro8179.5
MMVU78.980.8
MotionBench70.364.8
mrcr_v2_8needle_128k_average7783.8
MultiNRC5942.2
OCRBench90.380.7
ocrbench_v263.450.5
OmniDocBench 1.588.585.7
OmniScience Accuracy55.844.3
OmniScience Non-Hallucination1038.4
PropensityBench52.934.4
scicode56.152.1
screenspot_pro_no_tools72.786.3
SEAL VISTA51.546.6
Seal-045.545
simplebench76.445.8
simpleqa_verified72.938.9
SimpleVQA69.755.8
swe_bench_bash74.272.8
SWE-bench Multilingual68.772
SWE-bench Pro43.355.6
SWE-bench Verified7880
SWE-Perf6.53.6
SWT-bench79.780.7
Terminal-Bench 2.054.254
Terminal-Bench Hard56.962.2
tool_decathlon36.446.3
toolathlon36.446.3
vectara_answer_rate99.4100
vectara_avg_summary_length101.9186.3
vectara_factual_consistency86.489.2
vectara_hallucination_rate13.610.8
Video-MME88.486
VideoMMMU87.685.9
WorldVQA47.428
ZeroBench89
ZeroBench (w/ tools)127
τ²-Bench9885.5
τ²-Bench Telecom (AA run)9898.7

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.