VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemma 4 26B A4B vs Llama 3.1 Instruct 405B

GooglevsMeta31 shared benchmarks1911 head-to-head
BenchmarkGemma 4 26B A4BLlama 3.1 Instruct 405B
AA Agentic Index32.16.3
AA Intelligence26.18.5
AA-LCR61.724.7
AA-Omniscience-50.8-17.1
arc_challenge92.896.9
Artificial Analysis Coding Index39.314.5
C-Eval82.572.5
critpt00
gdpval25.70
GPQA Diamond82.351.5
GSM8K7796.8
hellaswag85.389.2
HLE19.34.2
humaneval5089
IFBench72.439
ifeval96.488.6
LiveCodeBench79.830.1
MBPP68.473.4
mmlu77.888.6
mmlu_redux92.786.2
MMLU-Pro85.273.4
mmmlu86.373.8
OmniScience Accuracy19.123.2
OmniScience Non-Hallucination13.649
OpenBookQA48.894
scicode40.329.9
SWE-bench Pro13.811.2
SWE-bench Verified57.424.5
Terminal-Bench Hard256.8
winogrande79.186.7
τ²-Bench Telecom (AA run)43.619

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.