VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Sonnet 4 vs GLM-5.1

AnthropicvsZ.ai27 shared benchmarks423 head-to-head
BenchmarkClaude Sonnet 4GLM-5.1
AA Agentic Index39.266
AA Intelligence29.841
AA-LCR69.768
AA-Omniscience0.20.8
Artificial Analysis Coding Index37.655.8
browsecomp12.279.3
critpt1.14.6
frontiermath_tier_4012.5
gdpval31.249.5
GPQA Diamond7886.8
HLE10.752.3
HLE (with tools)20.352.3
HMMT 202515.994
IFBench5576.3
livebench74.870.2
MMLU-Pro8486
OmniScience Accuracy22.725.2
OmniScience Non-Hallucination70.970.1
scicode4043.8
simplebench45.555.1
SWE-bench Multilingual56.973.3
SWE-bench Pro42.758.4
TauBench V3 - Banking16.713.6
Terminal-Bench 2.136.363.5
Terminal-Bench Hard31.143.2
τ²-Bench Telecom (AA run)64.697.7
τ³-Bench13.870.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.