VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Opus 4 vs Qwen3.5 2B

19 SHARED BENCHMARKS

Across 19 shared benchmarks, Claude Opus 4 scores higher on 18 and Qwen3.5 2B on 1. The widest gap is Terminal-Bench Hard, where Claude Opus 4 scores 31.1 against 3.8.

ANTHROPICVSALIBABA19 SHARED181 HEAD-TO-HEAD

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Opus 4 withALL PAIRINGS →

Compare Qwen3.5 2B withALL PAIRINGS →