VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Kimi K2.5 vs Qwen3.5 27B

MoonshotvsAlibaba57 shared benchmarks4413 head-to-head
BenchmarkKimi K2.5Qwen3.5 27B
AA Agentic Index52.854.6
AA Intelligence3634.6
AA-LCR7372.3
AA-Omniscience-7.3-44
aime_202695.892.6
arena_vision12471221
Artificial Analysis Coding Index46.834.9
baby_vision36.544.6
browsecomp74.961
browsecomp_zh62.362.1
charxiv_rq78.779.5
coding_arena_elo14361357
critpt3.10.9
gdpval38.333
GPQA Diamond87.985.8
HLE50.248.5
HMMT 202595.489.8
hmmt_feb_202595.492
hmmt_feb_202687.184.3
hmmt_nov_202591.189.8
IFBench70.276.5
imo_answer_bench81.879.9
LiveCodeBench v68580.7
longbench_v26160.6
LVBench75.973.6
mathvision84.286
MathVista90.187.8
MCP Atlas6468.4
mcpmark29.536.3
MMLU-Pro87.186.1
MMMU-Pro78.575
MMVU80.473.3
multichallenge61.460.8
nl2repo3227.3
OCRBench92.389.4
OmniDocBench 1.588.888.9
OmniScience Accuracy35.220.7
OmniScience Non-Hallucination5024.9
OSWorld-Verified63.356.2
scicode4939.5
Seal-057.447.2
SimpleVQA71.256
SWE-bench Multilingual7369.3
SWE-bench Pro53.851.2
SWE-bench Verified76.875
Terminal-Bench 2.050.841.6
Terminal-Bench Hard34.832.6
tool_decathlon27.831.5
vectara_answer_rate92.299.8
vectara_avg_summary_length11294.4
vectara_factual_consistency85.887.9
vectara_hallucination_rate14.212.1
VideoMMMU86.682.3
WideSearch7966.4
ZeroBench90.1
τ²-Bench Telecom (AA run)95.993.9
τ³-Bench6668.4

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.