VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Opus 4.5 vs Qwen Drive 1.0 SFT

6 SHARED BENCHMARKS

Across 6 shared benchmarks, Claude Opus 4.5 scores higher on 3 and Qwen Drive 1.0 SFT on 3. The widest gap is SimpleVQA, where Claude Opus 4.5 scores 69.7 against 46.1.

ANTHROPICVSALIBABA6 SHARED33 HEAD-TO-HEAD
ERQA46.848.5
MMMU80.772.7
MMStar73.275.9
OCRBench86.586.4
SimpleVQA69.746.1

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Opus 4.5 withEVERY TRACKED PAIRING

Anthropic11 PAIRINGS
OpenAI11 PAIRINGS
Google10 PAIRINGS
Alibaba12 PAIRINGS
DeepSeek4 PAIRINGS
Moonshot4 PAIRINGS
Meta2 PAIRINGS
Z.ai2 PAIRINGS
MiniMax1 PAIRING
NVIDIA2 PAIRINGS