VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs Claude Opus 4.8

AnthropicvsAnthropic80 shared benchmarks7010 head-to-head
BenchmarkClaude Fable 5Claude Opus 4.8
AA Agentic Index56.649.4
AA Intelligence62.157.3
AA-LCR76.773
AA-Omniscience43.328.8
Agents' Last Exam25.727
AndroidBench84.569.8
apex_agents59.239.4
arc_agi_190.592.5
ARC-AGI-276.872.1
arena_elo15081482
arena_text_factuality14861464
arena_vision13071280
Artificial Analysis Coding Index76.574.3
baby_vision_with_python90.581.2
browsecomp8888.5
charxiv_rq89.480.5
coding_arena_elo16261539
CorpFin v271.866.7
critpt28.620.9
deepsearchqa_f194.293.1
DeepSWE7059
DeepSWE 1.17059
Finance Agent v256.353.9
GDP (Surge AI)29.884.8
gdpval61.954.2
GDPval-AA (Elo)19321890
GDPval-AA v217601593
GDPval-AA v2 (Elo)17471593
GPQA Diamond92.693.6
healthbench_professional6657.4
HiL-Bench56.335.3
HLE64.557.9
HLE (with tools)64.557.9
IFBench63.562.2
JobBench57.448.4
Legal Agent Benchmark13.310
Legal Research Bench49.543.8
livebench78.377.2
livebench_agentic_coding62.250.5
livebench_coding8681.8
livebench_data_analysis80.566
livebench_instruction_following75.872
livebench_language90.779.7
livebench_math9694.3
livebench_reasoning89.789.2
mathvision94.886.7
MCP Atlas84.783.6
MCP Mark Verified87.476.4
MLS Bench Lite49.942.8
MMMU-Pro84.278.9
officeqa_pro69.966.2
OmniDocBench89.887.9
OmniScience Accuracy65.348.8
OmniScience Non-Hallucination36.460.7
OSWorld 2.066.155.7
OSWorld-Verified8583.4
PaperBench88.880.3
PerceptionBench57.247.2
PostTrainBench41.437.2
Program Bench76.871.9
scicode60.253.5
simplebench81.964.8
simpleqa_verified68.339.5
SpreadsheetBench 234.731.6
swe_bench_multimodal54.138.4
SWE-bench Multilingual86.684.4
SWE-bench Pro8069.2
SWE-bench Verified9588.6
SWE-Marathon3540
Tau 3 Banking26.827.6
TauBench V3 - Banking38.134.2
Terminal-Bench 2.18885
Terminal-Bench Hard62.958.3
toolathlon61.759.9
Toolathlon Avg turns19.824.5
Toolathlon Pass@∞55.648.1
WideSearch81.272.9
WorldVQA ForceAnswer56.739.1
τ²-Bench Telecom (AA run)98.594.4
τ³-Bench26.827.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.