VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs Claude Sonnet 4.5

AnthropicvsAnthropic37 shared benchmarks352 head-to-head
BenchmarkClaude Fable 5Claude Sonnet 4.5
AA Agentic Index56.650.6
AA Intelligence62.137.4
AA-LCR76.768.3
AA-Omniscience43.3-0.1
arc_agi_190.563.7
ARC-AGI-276.813.6
arena_elo15081456
arena_text_factuality14861448
Artificial Analysis Coding Index76.552.1
browsecomp8824.1
charxiv_rq89.467.2
coding_arena_elo16261392
critpt28.61.1
gdpval61.940.4
GPQA Diamond92.683.4
HLE64.519.8
HLE (with tools)64.532
IFBench63.557.3
MCP Atlas84.759.5
MMMU-Pro84.268.7
OmniScience Accuracy65.332.9
OmniScience Non-Hallucination36.450.9
OSWorld-Verified8561.4
scicode60.245
simplebench81.954.3
simpleqa_verified68.323.6
SWE-bench Multilingual86.668
SWE-bench Pro8043.6
SWE-bench Verified9582
TauBench V3 - Banking38.124.5
Terminal-Bench 2.18855.8
Terminal-Bench Hard62.935.6
toolathlon61.741
Toolathlon Avg turns19.832
Toolathlon Pass@∞55.628.7
τ²-Bench Telecom (AA run)98.578.1
τ³-Bench26.819

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.