VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Gemini 3.1 Pro vs Kimi K3

GooglevsMoonshot54 shared benchmarks1341 head-to-head
BenchmarkGemini 3.1 ProKimi K3
AA Agentic Index2354.3
AA Intelligence47.760
AA-LCR7982.7
AA-Omniscience32.946
aime_202698.396.7
apex_agents33.541
apexAgents33.541.3
arc_agi_19865.7
ARC-AGI-277.112.4
arena_elo14861489
arena_text_factuality14711471
Artificial Analysis Coding Index68.876.2
baby_vision51.685.7
baby_vision_with_python68.385.7
browsecomp85.991.2
charxiv_rq89.984.8
coding_arena_elo14471674
critpt17.723.4
cybergym38.880
deepsearchqa_f181.995
DeepSWE1067.5
DeepSWE 1.11269
Finance Agent v24354.4
gdpval23.359.4
GDPval-AA v29621687
GPQA Diamond94.393.5
HLE51.456
hmmt_feb_202694.797
itbenchSre30.347.7
livebench_agentic_coding44.162.2
livebench_coding76.581.5
livebench_data_analysis78.578.7
livebench_instruction_following79.171.4
livebench_language85.485.5
livebench_math9184.4
livebench_reasoning8490.7
matharena_visual_math_overall89.491.3
mathvision89.897.8
MCP Atlas78.284.2
MMMU-Pro8383.4
officeqa_pro42.963.3
OmniScience Accuracy55.347.6
OmniScience Non-Hallucination50.149.1
OSWorld-Verified76.284.8
PostTrainBench21.636.6
Program Bench39.577.8
scicode5958.7
simplebench79.660.7
simpleqa_verified77.342.7
SWE-Marathon442
Tau 3 Banking16.533.4
TauBench V3 - Banking21.446
Terminal-Bench 2.17488.3
toolathlon48.873.2

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.