VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemma 4 26B A4B vs Kimi K2.5

GooglevsMoonshot49 shared benchmarks247 head-to-head
BenchmarkGemma 4 26B A4BKimi K2.5
AA Agentic Index32.152.8
AA Intelligence26.136
AA-LCR61.773
AA-Omniscience-50.8-7.3
AIME 20259096.1
aime_202688.395.8
arena_elo14381450
arena_text_factuality14451445
arena_vision12381247
Artificial Analysis Coding Index39.346.8
browsecomp26.374.9
charxiv_rq6978.7
coding_arena_elo13611436
critpt03.1
gdpval25.738.3
GDPval-AA v28071009
GPQA Diamond82.387.9
HLE19.350.2
HLE (with tools)17.251.8
hmmt_feb_202591.795.4
hmmt_feb_20267987.1
hmmt_nov_202587.591.1
IFBench72.470.2
imo_answer_bench74.381.8
LiveCodeBench v677.185
mathvision82.484.2
MathVista79.490.1
MCP Atlas5064
mcpmark14.229.5
MMLU-Pro85.287.1
MMMU-Pro73.878.5
nl2repo11.632
OmniDocBench 1.574.488.8
OmniScience Accuracy19.135.2
OmniScience Non-Hallucination13.650
scicode40.349
SimpleVQA52.271.2
SWE-bench Multilingual43.473
SWE-bench Pro13.853.8
SWE-bench Verified57.476.8
TauBench V3 - Banking1214.2
Terminal-Bench 2.034.250.8
Terminal-Bench 2.13945.7
Terminal-Bench Hard2534.8
tool_decathlon1227.8
WideSearch38.379
τ²-Bench68.285.4
τ²-Bench Telecom (AA run)43.695.9
τ³-Bench5966

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.