VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-5.2 vs Kimi K2 (Reasoning)

OpenAIvsMoonshot41 shared benchmarks401 head-to-head
BenchmarkGPT-5.2Kimi K2 (Reasoning)
AA Agentic Index60.247.9
AA Intelligence43.333.5
AA-LCR79.370.3
AA-Omniscience0.3-21.4
AIME 202510094.5
AIME25 no tools9894.5
Artificial Analysis Coding Index48.734.8
browsecomp65.860.2
browsecomp_with_context_manager65.860.2
browsecomp_zh76.162.3
critpt11.62.6
frontiermath_tier_418.80
gdpval48.324.5
GPQA (unspecified)92.474.2
GPQA Diamond92.484.5
HLE45.523.9
HLE (with tools)45.544.9
HMMT 202599.489.4
hmmt_feb_202510093.3
hmmt_nov_202599.289.2
IFBench75.468.1
imo_answer_bench86.378.6
LiveCodeBench8979.2
longbench_v254.545.1
MMLU-Pro8784.6
OmniScience Accuracy44.330.9
OmniScience Non-Hallucination38.425.8
scicode52.144.8
Seal-04556.3
simplebench45.839.6
swe_bench_bash72.863.4
SWE-bench Multilingual7261.1
SWE-bench Verified8071.3
Terminal-Bench 2.05435.7
Terminal-Bench Hard62.231.1
vectara_answer_rate10098.6
vectara_avg_summary_length186.359.2
vectara_factual_consistency89.282.1
vectara_hallucination_rate10.817.9
τ²-Bench85.574.3
τ²-Bench Telecom (AA run)98.793

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.