VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs DeepSeek-V4-Pro

AnthropicvsDeepSeek51 shared benchmarks483 head-to-head
BenchmarkClaude Fable 5DeepSeek-V4-Pro
AA Agentic Index56.663.3
AA Intelligence62.153
AA-LCR76.770
AA-Omniscience43.3-10.6
Agents' Last Exam25.716.5
arena_elo15081457
arena_text_factuality14861450
Artificial Analysis Coding Index76.559.4
browsecomp8883.4
BrowseComp (w/ Ctx)8883.4
coding_arena_elo16261582
critpt28.613
DeepSWE7012.8
FORTRESS (Adversarial)9636
FORTRESS (Benign)55.198.5
gdpval61.949
GDPval-AA (Elo)19321554
GDPval-AA v217601307
Global-MMLU-Lite93.389.3
GPQA Diamond92.690.5
HLE64.548.2
HLE (with tools)64.548.2
IFBench63.576.5
livebench78.373.6
livebench_agentic_coding62.242.6
livebench_coding8670
livebench_data_analysis80.574.5
livebench_instruction_following75.862.4
livebench_language90.778.1
livebench_math9690.7
livebench_reasoning89.782.7
MCP Atlas84.774.2
OmniScience Accuracy65.343
OmniScience Non-Hallucination36.412.2
Program Bench76.847.8
scicode60.250
simplebench81.950.9
simpleqa_verified68.357.9
strongreject98.798.6
SWE-bench Multilingual86.676.2
SWE-bench Pro8055.4
SWE-bench Verified9580.6
SWEBench Pro (Public)8055.4
Tau 3 Banking26.826
TauBench V3 - Banking38.130.1
Terminal Bench 2.1 (Best Harness)84.664
Terminal-Bench 2.18872.1
Terminal-Bench Hard62.946.2
toolathlon61.751.8
τ²-Bench Telecom (AA run)98.596.2
τ³-Bench26.825.8

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.