Claude Fable 5.1 vs GPT-6 Astra
32 SHARED BENCHMARKSAcross 32 shared benchmarks, Claude Fable 5.1 scores higher on 17 and GPT-6 Astra on 15. The widest gap is OmniScience Non-Hallucination, where GPT-6 Astra scores 55.2 against 34.4.
ANTHROPICVSOPENAI32 SHARED17–15 HEAD-TO-HEAD
Terminal-Bench 4.05657.7
Terminal-Bench-Science 0.152.664.6
Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.
Compare Claude Fable 5.1 withEVERY TRACKED PAIRING
▶Anthropic12 PAIRINGS
▶OpenAI11 PAIRINGS
▶Google9 PAIRINGS
▶Alibaba11 PAIRINGS
▶DeepSeek4 PAIRINGS
▶Moonshot4 PAIRINGS
▶Meta2 PAIRINGS
▶Z.ai2 PAIRINGS
▶MiniMax1 PAIRING
▶NVIDIA2 PAIRINGS
Compare GPT-6 Astra withEVERY TRACKED PAIRING
▶Anthropic12 PAIRINGS
▶OpenAI11 PAIRINGS
▶Google9 PAIRINGS
▶Alibaba11 PAIRINGS
▶DeepSeek4 PAIRINGS
▶Moonshot4 PAIRINGS
▶Meta2 PAIRINGS
▶Z.ai2 PAIRINGS
▶MiniMax1 PAIRING
▶NVIDIA2 PAIRINGS