VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Gemma 4 31B vs InternVL3.5-8B-Instruct

6 SHARED BENCHMARKS

Across 6 shared benchmarks, Gemma 4 31B scores higher on 6 and InternVL3.5-8B-Instruct on 0. The widest gap is ERQA, where Gemma 4 31B scores 57.5 against 42.

GOOGLEVSOPENGVLAB6 SHARED60 HEAD-TO-HEAD
ERQA57.542
MMMU80.462
MMStar77.364.1
OCRBench86.183.2
RealWorldQA72.366.9
SimpleVQA52.940.8

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Gemma 4 31B withEVERY TRACKED PAIRING

Anthropic12 PAIRINGS
OpenAI11 PAIRINGS
Google9 PAIRINGS
Alibaba12 PAIRINGS
DeepSeek4 PAIRINGS
Moonshot4 PAIRINGS
Meta2 PAIRINGS
Z.ai2 PAIRINGS
MiniMax1 PAIRING
NVIDIA2 PAIRINGS