VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Kimi K2.6 vs Qwen3.7 Max

MoonshotvsAlibaba46 shared benchmarks1234 head-to-head
BenchmarkKimi K2.6Qwen3.7 Max
AA Agentic Index58.730.9
AA Intelligence45.146.7
AA-LCR76.774.7
AA-Omniscience6.413.5
aime_202696.497
arena_elo14611474
arena_text_factuality14551479
Artificial Analysis Coding Index61.866
Claw Eval (pass@3)80.965.2
coding_arena_elo15091517
critpt813.4
Finance Agent v244.948.4
gdpval41.438.5
GPQA Diamond91.192.4
HLE37.541.4
HLE (with tools)5453.5
hmmt_feb_202694.797.1
IFBench7680.5
imo_answer_bench8690
itbenchSre31.242.5
livebench72.274.3
livebench_agentic_coding46.943.6
livebench_coding78.674.2
livebench_data_analysis65.171.8
livebench_instruction_following64.474
livebench_language75.179.7
livebench_math84.385.3
livebench_reasoning79.483.3
LiveCodeBench v689.691.6
MCP Atlas68.176.4
mcpmark55.960.8
MMLU-Pro87.189.6
OmniScience Accuracy32.831.1
OmniScience Non-Hallucination60.774.4
scicode53.553.5
simpleqa_verified38.758.5
SWE-bench Multilingual76.778.3
SWE-bench Pro58.660.6
SWE-bench Verified80.280.4
TauBench V3 - Banking23.311.8
Terminal-Bench 2.066.769.7
Terminal-Bench 2.165.975
Terminal-Bench Hard43.950.8
WideSearch80.875.2
τ²-Bench Telecom (AA run)95.994.7
τ³-Bench20.610.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.