VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Kimi K2.5 vs Qwen3.5 35B A3B

MoonshotvsAlibaba58 shared benchmarks499 head-to-head
BenchmarkKimi K2.5Qwen3.5 35B A3B
AA Agentic Index52.844.1
AA Intelligence3629.9
AA-LCR7368.3
AA-Omniscience-7.3-48.1
aime_202695.893.3
Artificial Analysis Coding Index46.837
baby_vision36.538.4
browsecomp74.961
browsecomp_zh62.369.5
charxiv_rq78.777.5
coding_arena_elo14361250
critpt3.10.9
gdpval38.320.3
GPQA Diamond87.984.5
HLE50.247.4
HMMT 202595.489.2
hmmt_feb_202595.489
hmmt_feb_202687.181.8
hmmt_nov_202591.189.2
IFBench70.272.5
imo_answer_bench81.876.8
LiveCodeBench v68574.6
longbench_v26159
LVBench75.971.4
mathvision84.283.9
MathVista90.186.2
MCP Atlas6462.4
mcpmark29.527
MMLU-Pro87.185.3
MMMU-Pro78.575.1
MMVU80.472.3
multichallenge61.460
nl2repo3220.5
OCRBench92.391
OmniDocBench 1.588.889.3
OmniScience Accuracy35.220.1
OmniScience Non-Hallucination5014.6
OSWorld-Verified63.354.5
scicode4937.7
Seal-057.441.4
SimpleVQA71.258.3
SWE-bench Multilingual7360.3
SWE-bench Pro53.844.6
SWE-bench Verified76.870
TauBench V3 - Banking14.24.9
Terminal-Bench 2.050.840.5
Terminal-Bench 2.145.740.8
Terminal-Bench Hard34.826.5
tool_decathlon27.828.7
vectara_answer_rate92.299.8
vectara_avg_summary_length11294.9
vectara_factual_consistency85.889.5
vectara_hallucination_rate14.210.5
VideoMMMU86.680.4
WideSearch7959.1
ZeroBench90.1
τ²-Bench Telecom (AA run)95.989.2
τ³-Bench6668.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.