VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3 Pro vs Kimi K2.6

GooglevsMoonshot47 shared benchmarks1928 head-to-head
BenchmarkGemini 3 ProKimi K2.6
AA Agentic Index5258.7
AA Intelligence40.645.1
AA-LCR7376.7
AA-Omniscience15.36.4
aime_202691.796.4
apexAgents18.428.5
arena_elo14851461
arena_text_factuality14811455
arena_vision12901264
Artificial Analysis Coding Index46.561.8
browsecomp59.286.3
charxiv_rq81.486.7
coding_arena_elo14381509
critpt9.18
deepsearchqa_f163.292.5
frontiermath_tier_418.814.6
gdpval34.241.4
GDPval-AA (Elo)11951482
GPQA Diamond91.991.1
HLE45.837.5
HLE (with tools)45.854
hmmt_feb_202686.494.7
IFBench70.476
imo_answer_bench83.386
livebench73.472.2
LiveCodeBench9289.6
LiveCodeBench v690.789.6
mathvision86.193.2
MCP Atlas70.368.1
MMLU-Pro90.187.1
MMMU-Pro8180.1
OmniScience Accuracy55.832.8
OmniScience Non-Hallucination1060.7
scicode56.153.5
simpleqa_verified72.938.7
SWE-bench Multilingual68.776.7
SWE-bench Pro43.358.6
SWE-bench Verified7880.2
Terminal-Bench 2.054.266.7
Terminal-Bench Hard56.943.9
toolathlon36.450
vectara_answer_rate99.499.7
vectara_avg_summary_length101.9116.7
vectara_factual_consistency86.489.2
vectara_hallucination_rate13.610.8
WideSearch (item-f1)5780.8
τ²-Bench Telecom (AA run)9895.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.