VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Mythos 5.1 vs Claude Sonnet 5

4 SHARED BENCHMARKS

Across 4 shared benchmarks, Claude Mythos 5.1 scores higher on 4 and Claude Sonnet 5 on 0. The widest gap is Terminal-Bench 4.0, where Claude Mythos 5.1 scores 60.9 against 12.4.

ANTHROPICVSANTHROPIC4 SHARED40 HEAD-TO-HEAD
BioMysteryBench (Human Difficult)44.139.4
BioMysteryBench (Human Solvable)90.384.9
Terminal-Bench 4.060.912.4

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Sonnet 5 withEVERY TRACKED PAIRING

Anthropic11 PAIRINGS
OpenAI11 PAIRINGS
Google11 PAIRINGS
Alibaba11 PAIRINGS
DeepSeek5 PAIRINGS
Moonshot4 PAIRINGS
Meta2 PAIRINGS
Z.ai2 PAIRINGS
MiniMax1 PAIRING
NVIDIA1 PAIRING