Qwen3 4B VL vs Qwen3 VL 235B A22B Reasoning
5 SHARED BENCHMARKSAcross 5 shared benchmarks, Qwen3 4B VL scores higher on 1 and Qwen3 VL 235B A22B Reasoning on 4. The widest gap is OCRBenchv2 KIE (zh), where Qwen3 4B VL scores 71.3 against 62.9.
ALIBABAVSALIBABA5 SHARED1–4 HEAD-TO-HEAD
Key Information Extraction Overall83.584.2
OCRBench KIE8994
OCRBenchv2 KIE (en)82.185.6
OCRBenchv2 KIE (zh)71.362.9
Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.
Compare Qwen3 VL 235B A22B Reasoning withEVERY TRACKED PAIRING
▶Anthropic12 PAIRINGS
▶OpenAI11 PAIRINGS
▶Google10 PAIRINGS
▶Alibaba11 PAIRINGS
▶DeepSeek4 PAIRINGS
▶Moonshot4 PAIRINGS
▶Meta2 PAIRINGS
▶Z.ai2 PAIRINGS
▶MiniMax1 PAIRING
▶NVIDIA2 PAIRINGS