VECTOR WIREAI INTELLIGENCE
UTC
Refresh Models Deals Regulatory Sources

Claude Mythos 5.1 vs Claude Opus 5

4 SHARED BENCHMARKS

Across 4 shared benchmarks, Claude Mythos 5.1 scores higher on 2 and Claude Opus 5 on 2. The widest gap is BioMysteryBench (Human Difficult), where Claude Opus 5 scores 51.8 against 44.1.

ANTHROPICVSANTHROPIC4 SHARED22 HEAD-TO-HEAD
BioMysteryBench (Human Difficult)44.151.8
BioMysteryBench (Human Solvable)90.391.4
Terminal-Bench 4.060.952

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.

Compare Claude Opus 5 withEVERY TRACKED PAIRING

Anthropic11 PAIRINGS
OpenAI11 PAIRINGS
Google11 PAIRINGS
Alibaba11 PAIRINGS
DeepSeek5 PAIRINGS
Moonshot4 PAIRINGS
Meta2 PAIRINGS
Z.ai2 PAIRINGS
MiniMax1 PAIRING
NVIDIA1 PAIRING