VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Fable 5 vs GLM-5.2 Full Open Source

AnthropicvsZ.ai57 shared benchmarks504 head-to-head
BenchmarkClaude Fable 5GLM-5.2 Full Open Source
AA Agentic Index56.645.7
AA Intelligence62.152.6
AA-LCR76.776.7
AA-Omniscience43.34.4
Agents' Last Exam25.723.8
apex_agents59.235.6
arc_agi_190.577
ARC-AGI-276.822.8
arena_elo15081471
arena_text_factuality14861460
Artificial Analysis Coding Index76.568.8
coding_arena_elo16261582
critpt28.620.9
DeepSWE7046.2
DeepSWE 1.17044
FORTRESS (Adversarial)9671.3
FORTRESS (Benign)55.190
gdpval61.950.3
GDPval-AA v217601514
GDPval-AA v2 (Elo)17471510
Global-MMLU-Lite93.389.2
GPQA Diamond92.691.2
HiL-Bench56.343.7
HLE64.554.7
HLE (with tools)64.554.7
IFBench63.573.3
JobBench57.443.4
livebench_agentic_coding62.251.8
livebench_coding8679.7
livebench_data_analysis80.573.7
livebench_instruction_following75.862.3
livebench_language90.776.2
livebench_math9689.8
livebench_reasoning89.778.6
MCP Atlas84.782.6
MLS Bench Lite49.940.4
officeqa_pro69.941.4
OmniScience Accuracy65.324.3
OmniScience Non-Hallucination36.473.7
PostTrainBench41.434.3
Program Bench76.863.7
scicode60.250.5
simplebench81.958.8
simpleqa_verified68.338.1
SpreadsheetBench 234.728.1
strongreject98.798.5
SWE-bench Pro8062.1
SWE-Marathon3513
SWEBench Pro (Public)8062.1
Tau 3 Banking26.826.8
TauBench V3 - Banking38.134.6
Terminal Bench 2.1 (Best Harness)84.682.7
Terminal-Bench 2.18882.7
Terminal-Bench Hard62.950.8
toolathlon61.748.2
τ²-Bench Telecom (AA run)98.599.1
τ³-Bench26.826.8

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.