VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs Kimi K2.5

AnthropicvsMoonshot51 shared benchmarks465 head-to-head
BenchmarkClaude Fable 5Kimi K2.5
AA Agentic Index56.652.8
AA Intelligence62.136
AA-LCR76.773
AA-Omniscience43.3-7.3
arc_agi_190.565.3
ARC-AGI-276.811.8
arena_elo15081450
arena_text_factuality14861445
arena_vision13071247
Artificial Analysis Coding Index76.546.8
baby_vision_with_python90.540.5
browsecomp8874.9
BrowseComp (w/ Ctx)8874.9
charxiv_rq89.478.7
coding_arena_elo16261436
critpt28.63.1
deepsearchqa_f194.289
FORTRESS (Adversarial)9654.1
FORTRESS (Benign)55.198.3
gdpval61.938.3
GDPval-AA v217601009
Global-MMLU-Lite93.384
GPQA Diamond92.687.9
HLE64.550.2
HLE (with tools)64.551.8
IFBench63.570.2
livebench78.369.1
mathvision94.884.2
MCP Atlas84.764
MMMU-Pro84.278.5
OmniScience Accuracy65.335.2
OmniScience Non-Hallucination36.450
OSWorld-Verified8563.3
PaperBench88.863.5
scicode60.249
simplebench81.946.8
simpleqa_verified68.336.9
strongreject98.799.5
SWE-bench Multilingual86.673
SWE-bench Pro8053.8
SWE-bench Verified9576.8
SWEBench Pro (Public)8050.7
Tau 3 Banking26.814.2
TauBench V3 - Banking38.114.2
Terminal Bench 2.1 (Best Harness)84.651.3
Terminal-Bench 2.18845.7
Terminal-Bench Hard62.934.8
toolathlon61.727.8
WideSearch81.279
τ²-Bench Telecom (AA run)98.595.9
τ³-Bench26.866

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.