VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSeek-V3.2 vs Kimi K2.5

DeepSeekvsMoonshot65 shared benchmarks1451 head-to-head
BenchmarkDeepSeek-V3.2Kimi K2.5
AA Agentic Index39.852.8
AA Intelligence32.836
AA-LCR70.773
AA-Omniscience-22.5-7.3
AIME 202593.196.1
AIME 2026 I92.792.5
aime_202695.195.8
apexAgents14.511.5
arc_agi_15765.3
ARC-AGI-2411.8
arena_text_factuality14331445
Artificial Analysis Coding Index44.246.8
browsecomp51.474.9
BrowseComp (context management)67.674.9
browsecomp_with_context_manager67.674.9
browsecomp_zh6562.3
coding_arena_elo13681436
critpt2.93.1
cybergym17.341.3
deepsearchqa_f160.989
FinSearchCompT2&T359.167.8
frontiermath_tier_42.14.2
gaia_no_file75.175.9
gdpval18.838.3
GPQA Diamond8487.9
HLE40.850.2
HLE (with tools)40.851.8
HMMT 202590.295.4
hmmt_feb_202592.595.4
hmmt_feb_202684.187.1
hmmt_nov_202590.291.1
IFBench6170.2
imo_answer_bench78.381.8
LiveCodeBench v683.385
longbench_v259.861
MCP Atlas62.264
mcpmark3829.5
MMLU-Pro8687.1
OJ-Bench (cpp)54.757.4
OmniScience Accuracy3335.2
OmniScience Non-Hallucination17.350
PaperBench47.163.5
ResearchRubrics55.859.5
scicode3949
Seal-049.557.4
simpleqa_verified27.536.9
swe_bench_bash6070.8
SWE-bench Multilingual70.273
SWE-bench Pro15.653.8
SWE-bench Verified73.176.8
TauBench V3 - Banking18.814.2
Terminal-Bench 2.046.450.8
Terminal-Bench 2.146.845.7
Terminal-Bench Hard35.634.8
tool_decathlon35.227.8
toolathlon35.227.8
vectara_answer_rate92.692.2
vectara_avg_summary_length62112
vectara_factual_consistency93.785.8
vectara_hallucination_rate6.314.2
WideSearch (item-f1)32.572.7
xbench_deepsearch7176.7
τ²-Bench9185.4
τ²-Bench Telecom (AA run)90.695.9
τ³-Bench69.266

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.