VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 2.5 Pro vs Kimi K2.5

GooglevsMoonshot53 shared benchmarks1043 head-to-head
BenchmarkGemini 2.5 ProKimi K2.5
AA Agentic Index7.252.8
AA Intelligence2736
AA-LCR6673
AA-Omniscience-14.3-7.3
AIME 202588.396.1
arc_agi_14165.3
ARC-AGI-24.911.8
arena_elo14461450
arena_text_factuality14621445
arena_vision12461247
Artificial Analysis Coding Index46.746.8
browsecomp9.974.9
browsecomp_zh32.262.3
coding_arena_elo12241436
critpt2.63.1
Fortress54.941.1
frontiermath_tier_44.24.2
gdpval8.538.3
Global-MMLU-Lite88.684
GPQA Diamond84.487.9
HLE22.550.2
HLE (with tools)28.451.8
HMMT 202565.795.4
hmmt_feb_202582.595.4
hmmt_nov_20258091.1
IFBench4970.2
matharena_visual_math_overall77.280.6
mathvision73.384.2
MathVista83.990.1
MMLU-Pro8687.1
MMMU-Pro74.978.5
multichallenge53.661.4
OCRBench85.992.3
OmniScience Accuracy3935.2
OmniScience Non-Hallucination12.650
scicode4349
SEAL VISTA50.841.9
simplebench62.446.8
simpleqa_verified5636.9
swe_bench_bash53.670.8
SWE-bench Verified67.276.8
TauBench V3 - Banking9.714.2
Terminal-Bench 2.128.545.7
Terminal-Bench Hard26.534.8
vectara_answer_rate99.192.2
vectara_avg_summary_length106.4112
vectara_factual_consistency9385.8
vectara_hallucination_rate714.2
Video-MME84.887.4
xbench_deepsearch5676.7
τ²-Bench5485.4
τ²-Bench Telecom (AA run)54.195.9
τ³-Bench9.366

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.