VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Pro vs Gemma 4 31B

GooglevsGoogle48 shared benchmarks435 head-to-head
BenchmarkGemini 3 ProGemma 4 31B
AA Agentic Index5214.4
AA Intelligence40.629.7
AA-LCR7368.3
AA-Omniscience15.3-47.9
aime_202691.789.2
arena_elo14851451
arena_text_factuality14811449
arena_vision12901252
Artificial Analysis Coding Index46.543.4
charxiv_rq81.467.9
coding_arena_elo14381364
critpt9.11.4
gdpval34.215.5
GPQA Diamond91.985.7
HLE45.826.5
HLE (with tools)45.826.5
hmmt_feb_202597.588.7
hmmt_feb_202686.477.2
hmmt_nov_202593.387.5
IFBench70.475.6
imo_answer_bench83.374.5
LiveCodeBench v690.780
mathvision86.185.6
MathVista89.879.3
MCP Atlas70.357.2
MMLU-Pro90.185.2
mmmlu91.888.4
MMMU-Pro8176.9
mrcr_v2_8needle_128k_average7766.4
OCRBench90.386.1
OmniDocBench 1.588.580.1
OmniScience Accuracy55.820
OmniScience Non-Hallucination1018.1
scicode56.143.4
simpleqa_verified72.99.6
SimpleVQA69.752.9
SWE-bench Multilingual68.751.7
SWE-bench Pro43.335.7
SWE-bench Verified7852
Terminal-Bench 2.054.242.9
Terminal-Bench Hard56.936.4
tool_decathlon36.421.2
vectara_answer_rate99.4100
vectara_avg_summary_length101.975.8
vectara_factual_consistency86.492.6
vectara_hallucination_rate13.67.4
τ²-Bench9876.9
τ²-Bench Telecom (AA run)9865.5

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.