VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-5.2 vs Kimi K2.6

OpenAIvsMoonshot54 shared benchmarks2230 head-to-head
BenchmarkGPT-5.2Kimi K2.6
AA Agentic Index60.258.7
AA Intelligence43.345.1
AA-LCR79.376.7
AA-Omniscience0.36.4
aime_202698.396.4
apexAgents2328.5
arena_elo14371461
arena_text_factuality14421455
arena_vision12451264
Artificial Analysis Coding Index48.761.8
browsecomp65.886.3
charxiv_rq82.186.7
coding_arena_elo14181509
critpt11.68
deepsearchqa_f171.392.5
frontiermath_tier_418.814.6
gdpval48.341.4
GDPval-AA (Elo)14621482
GPQA Diamond92.491.1
HLE45.537.5
HLE (with tools)45.554
hmmt_feb_20269794.7
IFBench75.476
imo_answer_bench86.386
livebench74.872.2
livebench_agentic_coding50.346.9
livebench_coding76.178.6
livebench_data_analysis78.265.1
livebench_instruction_following61.864.4
livebench_language79.875.1
livebench_math93.284.3
livebench_reasoning83.279.4
LiveCodeBench8989.6
mathvision8393.2
MCP Atlas6868.1
MMLU-Pro8787.1
MMMU-Pro79.580.1
OmniScience Accuracy44.332.8
OmniScience Non-Hallucination38.460.7
scicode52.153.5
simpleqa_verified38.938.7
SWE-bench Multilingual7276.7
SWE-bench Pro55.658.6
SWE-bench Verified8080.2
TauBench V3 - Banking11.123.3
Terminal-Bench 2.05466.7
Terminal-Bench Hard62.243.9
toolathlon46.350
vectara_answer_rate10099.7
vectara_avg_summary_length186.3116.7
vectara_factual_consistency89.289.2
vectara_hallucination_rate10.810.8
τ²-Bench Telecom (AA run)98.795.9
τ³-Bench1220.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.