VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs Gemini 3 Pro

GooglevsGoogle62 shared benchmarks519 head-to-head
BenchmarkGemini 3.1 ProGemini 3 Pro
AA Agentic Index2352
AA Intelligence47.740.6
AA-LCR7973
AA-Omniscience32.915.3
aime_202698.391.7
apexAgents33.518.4
arc_agi_19875
ARC-AGI-277.154
arena_elo14861485
arena_text_factuality14711481
arena_vision12801290
Artificial Analysis Coding Index68.846.5
browsecomp85.959.2
browsecomp_with_context_manager85.959.2
charxiv_rq89.981.4
coding_arena_elo14471438
critpt17.79.1
cybergym38.839.9
deepsearchqa_f181.963.2
Fortress29.841.7
frontiermath_tier_416.718.8
gdpval23.334.2
GDPval-AA (Elo)13171195
GPQA Diamond94.391.9
HLE51.445.8
HLE (with tools)51.645.8
hmmt_feb_202694.786.4
hmmt_nov_202594.893.3
IFBench77.170.4
imo_answer_bench9183.3
livebench79.973.4
LiveCodeBench91.792
LiveCodeBench Pro (Elo)28872439
LiveCodeBench v691.790.7
matharena_visual_math_overall89.484.2
mathvision89.886.1
MCP Atlas78.270.3
MMLU-Pro9190.1
mmmlu92.691.8
MMMU-Pro8381
mrcr_v2_8needle_128k_average84.977
mrcr_v2_8needle_1m_pointwise26.326.3
multichallenge71.465.7
MultiNRC64.759
OmniScience Accuracy55.355.8
OmniScience Non-Hallucination50.110
scicode5956.1
simplebench79.676.4
simpleqa_verified77.372.9
SWE-bench Multilingual76.968.7
SWE-bench Pro54.243.3
SWE-bench Verified80.678
Terminal-Bench 2.068.554.2
Terminal-Bench Hard68.556.9
tool_decathlon48.836.4
toolathlon48.836.4
vectara_answer_rate99.499.4
vectara_avg_summary_length107.7101.9
vectara_factual_consistency89.686.4
vectara_hallucination_rate10.413.6
VisualToolBench2926.9
τ²-Bench Telecom (AA run)99.398

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.