VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemma 4 26B A4B vs Gemma 4 E2B

GooglevsGoogle35 shared benchmarks313 head-to-head
BenchmarkGemma 4 26B A4BGemma 4 E2B
AA Agentic Index32.17.4
AA Intelligence26.110
AA-LCR61.717
AA-Omniscience-50.8-23.6
aime_202688.337.5
Artificial Analysis Coding Index39.38.3
BIG-Bench Extra Hard64.821.9
Claw-Eval Avg58.853.1
Codeforces ELO1718633
critpt00
gdpval25.70
GPQA Diamond82.343.4
HallusionBench66.10.6
HLE19.34.8
IFBench72.438
ifeval96.482.9
LiveCodeBench v677.144
mathvision82.452.4
MathVista79.462.1
MedXPertQA MM58.123.5
MMLU-Pro85.260
mmmlu86.367.4
MMMU-Pro73.844.6
mrcr_v2_8needle_128k_average44.119.1
OmniDocBench 1.5 (average edit distance, lower is better)0.10.3
OmniScience Accuracy19.18.2
OmniScience Non-Hallucination13.667.6
PinchBench74.744.2
RealWorldQA72.256.2
scicode40.320.9
TauBench V3 - Banking124.5
Terminal-Bench 2.1390.4
Terminal-Bench Hard253
τ²-Bench68.224.5
τ²-Bench Telecom (AA run)43.622.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.