VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Flash Preview vs GPT-5.5

GooglevsOpenAI47 shared benchmarks344 head-to-head
BenchmarkGemini 3 Flash PreviewGPT-5.5
AA Agentic Index49.747.4
AA Intelligence38.756.3
AA-LCR7379
AA-Omniscience10.120.5
aime_202696.7100
apexAgents27.737.7
arc_agi_184.795
ARC-AGI-233.685
arena_elo14731482
arena_text_factuality14521482
arena_vision12601283
Artificial Analysis Coding Index42.674.9
coding_arena_elo13871457
critpt8.627.1
Finance Agent v242.651.8
frontiermath_tier_44.235.4
gdpval35.249.5
GDPval-AA (Elo)12041769
GPQA Diamond90.493.6
HLE43.552.2
hmmt_feb_202689.498.5
hmmt_nov_202593.396.5
IFBench7875.9
Legal Agent Benchmark02.1
livebench72.480.7
matharena_visual_math_overall85.894.9
MCP Atlas6282.8
MMMU-Pro81.283.2
OmniScience Accuracy53.458
OmniScience Non-Hallucination7.612
OSWorld-Verified65.178.7
scicode50.656.1
simplebench61.169
simpleqa_verified67.463.1
SWE-bench Pro49.658.6
SWE-bench Verified7880.6
TauBench V3 - Banking20.839
Terminal-Bench 2.047.682.7
Terminal-Bench 2.15884.3
Terminal-Bench Hard38.660.6
toolathlon49.455.6
vectara_answer_rate99.8100
vectara_avg_summary_length90.2129.6
vectara_factual_consistency86.590.7
vectara_hallucination_rate13.59.3
τ²-Bench Telecom (AA run)80.493.9
τ³-Bench17.531.3

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.