VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemma 4 26B A4B vs Qwen3.7 Plus Preview

GooglevsAlibaba47 shared benchmarks542 head-to-head
BenchmarkGemma 4 26B A4BQwen3.7 Plus Preview
AA Agentic Index32.120.8
AA Intelligence26.139.4
AA-LCR61.769
AA-Omniscience-50.82.4
arena_elo14381458
arena_text_factuality14451454
arena_vision12381263
Artificial Analysis Coding Index39.355.9
charxiv_rq6985.9
Claw Eval (pass@3)2862.7
critpt09.1
DeepPlanning16.262.3
gdpval25.722.2
GPQA Diamond82.390.3
HLE19.335.6
hmmt_feb_20267992.9
IFBench72.479.1
ifeval96.494.6
imo_answer_bench74.386
LiveCodeBench v677.189.6
mathvision82.490.3
MCP Atlas5073.2
mcpmark14.258.7
MedXPertQA MM58.171
mmlu_redux92.794.5
MMLU-Pro85.288.5
mmmlu86.389
MMMU-Pro73.880.5
nl2repo11.641.1
OmniDocBench 1.574.491.4
OmniScience Accuracy19.122.5
OmniScience Non-Hallucination13.674.5
QwenClawBench38.761.8
RealWorldQA72.286.9
scicode40.351.3
SimpleVQA52.20.8
supergpqa61.471.4
SWE-bench Multilingual43.475.8
SWE-bench Pro13.857.6
SWE-bench Verified57.477.7
TauBench V3 - Banking1217.9
Terminal-Bench 2.034.270.3
Terminal-Bench 2.13961
Terminal-Bench Hard2547
VITA-Bench36.945.6
τ²-Bench Telecom (AA run)43.693
τ³-Bench5917.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.