VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Sonnet 4.5 vs Qwen3.5 2B

30 SHARED BENCHMARKS

Across 30 shared benchmarks, Claude Sonnet 4.5 scores higher on 28 and Qwen3.5 2B on 2. The widest gap is TauBench V3 - Banking, where Claude Sonnet 4.5 scores 24.5 against 2.5.

ANTHROPICVSALIBABA30 SHARED282 HEAD-TO-HEAD

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Sonnet 4.5 withALL PAIRINGS →

Compare Qwen3.5 2B withALL PAIRINGS →