VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GLM-5.1 vs GPT-5.1

Z.aivsOpenAI30 shared benchmarks209 head-to-head
BenchmarkGLM-5.1GPT-5.1
AA Agentic Index6632.2
AA Intelligence4137.5
AA-LCR6876.7
AA-Omniscience0.85.4
arena_elo14681439
arena_text_factuality14581445
Artificial Analysis Coding Index55.849.4
browsecomp79.350.8
coding_arena_elo15101421
critpt4.64.9
frontiermath_tier_412.512.5
gdpval49.525
GPQA Diamond86.888.1
HLE52.328.5
HLE (with tools)52.342.7
hmmt_nov_20259491.7
IFBench76.372.9
MCP Atlas75.650.1
MMLU-Pro8687
OmniScience Accuracy25.237.7
OmniScience Non-Hallucination70.148.1
scicode43.843.3
simplebench55.153.2
simpleqa_verified38.148.9
TauBench V3 - Banking13.615.9
Terminal-Bench 2.06947.6
Terminal-Bench 2.163.552.4
Terminal-Bench Hard43.245.5
τ²-Bench Telecom (AA run)97.781.9
τ³-Bench70.614

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.