VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Kimi K2.6 vs Qwen3.5 35B A3B

MoonshotvsAlibaba52 shared benchmarks475 head-to-head
BenchmarkKimi K2.6Qwen3.5 35B A3B
AA Agentic Index58.744.1
AA Intelligence45.129.9
AA-LCR76.768.3
AA-Omniscience6.4-48.1
AgentWorldBench - Android58.953.2
AgentWorldBench - MCP65.257.9
AgentWorldBench - OS60.856.3
AgentWorldBench - Overall53.447.7
AgentWorldBench - Search27.526
AgentWorldBench - SWE58.847.6
AgentWorldBench - Terminal52.546.1
AgentWorldBench - Web50.247.1
aime_202696.493.3
Artificial Analysis Coding Index61.837
baby_vision68.538.4
browsecomp86.361
charxiv_rq86.777.5
Claw Eval (pass@3)80.951
coding_arena_elo15091250
critpt80.9
gdpval41.420.3
GPQA Diamond91.184.5
HLE37.547.4
hmmt_feb_202694.781.8
IFBench7672.5
imo_answer_bench8676.8
itbenchSre31.221.5
LiveCodeBench v689.674.6
mathvision93.283.9
MCP Atlas68.162.4
mcpmark55.927
MMLU-Pro87.185.3
MMMU-Pro80.175.1
OJBench60.636
OmniScience Accuracy32.820.1
OmniScience Non-Hallucination60.714.6
OSWorld-Verified73.154.5
scicode53.537.7
SWE-bench Multilingual76.760.3
SWE-bench Pro58.644.6
SWE-bench Verified80.270
TauBench V3 - Banking23.34.9
Terminal-Bench 2.066.740.5
Terminal-Bench 2.165.940.8
Terminal-Bench Hard43.926.5
vectara_answer_rate99.799.8
vectara_avg_summary_length116.794.9
vectara_factual_consistency89.289.5
vectara_hallucination_rate10.810.5
WideSearch80.859.1
τ²-Bench Telecom (AA run)95.989.2
τ³-Bench20.668.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.