VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Opus 4.5 vs InternVL3.5-8B-Instruct

6 SHARED BENCHMARKS

Across 6 shared benchmarks, Claude Opus 4.5 scores higher on 6 and InternVL3.5-8B-Instruct on 0. The widest gap is SimpleVQA, where Claude Opus 4.5 scores 69.7 against 40.8.

ANTHROPICVSOPENGVLAB6 SHARED60 HEAD-TO-HEAD
ERQA46.842
MMMU80.762
MMStar73.264.1
OCRBench86.583.2
SimpleVQA69.740.8

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Opus 4.5 withEVERY TRACKED PAIRING

Anthropic11 PAIRINGS
OpenAI11 PAIRINGS
Google10 PAIRINGS
Alibaba12 PAIRINGS
DeepSeek4 PAIRINGS
Moonshot4 PAIRINGS
Meta2 PAIRINGS
Z.ai2 PAIRINGS
MiniMax1 PAIRING
NVIDIA2 PAIRINGS