VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Sonnet 4 vs Qwen3.5 2B

28 SHARED BENCHMARKS

Across 28 shared benchmarks, Claude Sonnet 4 scores higher on 27 and Qwen3.5 2B on 1. The widest gap is Terminal-Bench Hard, where Claude Sonnet 4 scores 31.1 against 3.8.

ANTHROPICVSALIBABA28 SHARED271 HEAD-TO-HEAD

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Sonnet 4 withALL PAIRINGS →

Compare Qwen3.5 2B withALL PAIRINGS →