VECTOR WIREAI INTELLIGENCE
PKT
Refresh Models Deals Regulatory Sources

Questions this page answers

Which is better, Claude 3.5 Sonnet or LlaVA-Interleave-Qwen-7B?
Across 2 shared benchmarks, Claude 3.5 Sonnet scores higher on 2 and LlaVA-Interleave-Qwen-7B on 0. The widest gap is Video-MME Overall, where Claude 3.5 Sonnet scores 55.9 against 50.2.

Claude 3.5 Sonnet vs LlaVA-Interleave-Qwen-7B

Across 2 shared benchmarks, Claude 3.5 Sonnet scores higher on 2 and LlaVA-Interleave-Qwen-7B on 0. The widest gap is Video-MME Overall, where Claude 3.5 Sonnet scores 55.9 against 50.2.

AnthropicvsAlibaba2 shared benchmarks20 head-to-head
BenchmarkClaude 3.5 SonnetLlaVA-Interleave-Qwen-7B
BLINK56.553.1
Video-MME Overall55.950.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.