VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Flash Preview vs GPT-5.2

GooglevsOpenAI57 shared benchmarks1740 head-to-head
BenchmarkGemini 3 Flash PreviewGPT-5.2
AA Agentic Index49.760.2
AA Intelligence38.743.3
AA-LCR7379.3
AA-Omniscience10.10.3
AIME 202599.7100
aime_202696.798.3
apexAgents27.723
arc_agi_184.786.2
ARC-AGI-233.652.9
arena_elo14731437
arena_text_factuality14521442
arena_vision12601245
Artificial Analysis Coding Index42.648.7
charxiv_rq80.382.1
coding_arena_elo13871418
critpt8.611.6
frontiermath_tier_44.218.8
gaia_level182.892.5
gaia_level26674.8
gaia_level34957.1
gaia_overall68.477.4
gdpval35.248.3
GDPval-AA (Elo)12041462
GPQA Diamond90.492.4
HLE43.545.5
hmmt_feb_202597.5100
hmmt_feb_202689.497
hmmt_nov_202593.399.2
IFBench7875.4
livebench72.474.8
matharena_visual_math_overall85.886.5
MCP Atlas6268
mmmlu91.889.6
MMMU-Pro81.279.5
mrcr_v2_8needle_128k_average67.283.8
OmniDocBench 1.512.185.7
OmniScience Accuracy53.444.3
OmniScience Non-Hallucination7.638.4
scicode50.652.1
screenspot_pro_no_tools69.186.3
simplebench61.145.8
simpleqa_verified67.438.9
swe_bench_bash75.872.8
SWE-bench Multilingual72.772
SWE-bench Pro49.655.6
SWE-bench Verified7880
TauBench V3 - Banking20.811.1
Terminal-Bench 2.047.654
Terminal-Bench Hard38.662.2
toolathlon49.446.3
vectara_answer_rate99.8100
vectara_avg_summary_length90.2186.3
vectara_factual_consistency86.589.2
vectara_hallucination_rate13.510.8
VideoMMMU86.985.9
τ²-Bench Telecom (AA run)80.498.7
τ³-Bench17.512

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.