VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs Kimi K2.6

AnthropicvsMoonshot58 shared benchmarks525 head-to-head
BenchmarkClaude Fable 5Kimi K2.6
AA Agentic Index56.658.7
AA Intelligence62.145.1
AA-LCR76.776.7
AA-Omniscience43.36.4
apex_agents59.227.9
arena_elo15081461
arena_text_factuality14861455
arena_vision13071264
Artificial Analysis Coding Index76.561.8
baby_vision_with_python90.568.5
browsecomp8886.3
BrowseComp (w/ Ctx)8883.2
charxiv_rq89.486.7
coding_arena_elo16261509
critpt28.68
deepsearchqa_f194.292.5
Finance Agent v256.344.9
FORTRESS (Adversarial)9665.6
FORTRESS (Benign)55.197.2
gdpval61.941.4
GDPval-AA (Elo)19321482
GDPval-AA v217601190
Global-MMLU-Lite93.388.4
GPQA Diamond92.691.1
HiL-Bench56.318.7
HLE64.537.5
HLE (with tools)64.554
IFBench63.576
livebench78.372.2
livebench_agentic_coding62.246.9
livebench_coding8678.6
livebench_data_analysis80.565.1
livebench_instruction_following75.864.4
livebench_language90.775.1
livebench_math9684.3
livebench_reasoning89.779.4
mathvision94.893.2
MCP Atlas84.768.1
MMMU-Pro84.280.1
OmniScience Accuracy65.332.8
OmniScience Non-Hallucination36.460.7
OSWorld-Verified8573.1
scicode60.253.5
simpleqa_verified68.338.7
strongreject98.799.8
SWE-bench Multilingual86.676.7
SWE-bench Pro8058.6
SWE-bench Verified9580.2
SWEBench Pro (Public)8058.6
Tau 3 Banking26.820.6
TauBench V3 - Banking38.123.3
Terminal Bench 2.1 (Best Harness)84.671.3
Terminal-Bench 2.18865.9
Terminal-Bench Hard62.943.9
toolathlon61.750
WideSearch81.280.8
τ²-Bench Telecom (AA run)98.595.9
τ³-Bench26.820.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.