VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Kimi K2.6 vs Qwen3.6 Plus

MoonshotvsAlibaba58 shared benchmarks489 head-to-head
BenchmarkKimi K2.6Qwen3.6 Plus
AA Agentic Index58.729
AA Intelligence45.140.5
AA-LCR76.772.3
AA-Omniscience6.42.6
AgentWorldBench - Android58.957.6
AgentWorldBench - MCP65.255.3
AgentWorldBench - OS60.860.3
AgentWorldBench - Overall53.450.8
AgentWorldBench - Search27.521.9
AgentWorldBench - SWE58.859.1
AgentWorldBench - Terminal52.550.6
AgentWorldBench - Web50.250.8
aime_202696.495.3
arena_elo14611444
arena_text_factuality14551438
Artificial Analysis Coding Index61.854.5
Claw Eval (pass@3)80.958.7
coding_arena_elo15091460
critpt82.9
Finance Agent v244.940.9
frontiermath_tier_414.68.3
gdpval41.432
GPQA Diamond91.190.4
HLE37.528.8
HLE (with tools)5450.6
hmmt_feb_202694.787.8
IFBench7675.2
imo_answer_bench8683.8
livebench72.270.8
livebench_agentic_coding46.941.4
livebench_coding78.678.2
livebench_data_analysis65.169.9
livebench_instruction_following64.458.3
livebench_language75.175
livebench_math84.383.7
livebench_reasoning79.475.8
LiveCodeBench v689.687.1
mathvision93.288
MCP Atlas68.174.1
mcpmark55.948.2
MMLU-Pro87.188.5
MMMU-Pro80.178.8
OmniScience Accuracy32.826.4
OmniScience Non-Hallucination60.768
OSWorld-Verified73.162.5
scicode53.540.7
simpleqa_verified38.749.1
SWE-bench Multilingual76.773.8
SWE-bench Pro58.656.6
SWE-bench Verified80.278.8
TauBench V3 - Banking23.320.8
Terminal-Bench 2.066.761.6
Terminal-Bench 2.165.961.4
Terminal-Bench Hard43.943.9
toolathlon5039.8
WideSearch80.874.3
τ²-Bench Telecom (AA run)95.997.7
τ³-Bench20.670.7

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.