VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Qwen3.6 27B vs Qwen3.7 Plus Preview

AlibabavsAlibaba52 shared benchmarks646 head-to-head
BenchmarkQwen3.6 27BQwen3.7 Plus Preview
AA Agentic Index27.520.8
AA Intelligence37.739.4
AA-LCR73.369
AA-Omniscience-202.4
Agents' Last Exam27.333.6
AndroidWorld70.381
Artificial Analysis Coding Index53.755.9
baby_vision28.970.4
charxiv_rq78.485.9
Claw Eval (pass@3)60.662.7
ClawEval-MM50.460.1
critpt1.19.1
DeepSWE 1.113.314.2
ERQA62.569.8
gdpval3222.2
GPQA Diamond87.890.3
HLE2435.6
hmmt_feb_202684.392.9
IFBench69.179.1
imo_answer_bench80.886
JobBench21.827.6
LiveCodeBench v683.989.6
mathvision85.190.3
MLVU86.687.4
mmlu_redux93.594.5
MMLU-Pro86.288.5
MMMU-Pro75.880.5
nl2repo36.241.1
OmniDocBench 1.589.491.4
OmniScience Accuracy19.622.5
OmniScience Non-Hallucination50.774.5
OSWorld-Verified63.973.3
QwenClawBench53.461.8
RealWorldQA84.186.9
RecreationBench29.830.2
scicode39.851.3
SimpleVQA56.10.8
supergpqa6671.4
SWE-bench Multilingual71.375.8
SWE-bench Pro53.557.6
SWE-bench Verified77.277.7
SWE-MM25.730
TauBench V3 - Banking16.717.9
Terminal Bench 2.1 (Terminus)63.464
Terminal-Bench 2.059.370.3
Terminal-Bench 2.160.761
Terminal-Bench Hard34.847
VideoMMMU84.485.4
Vision2Web4542.1
WebArena-Verified48.855.3
τ²-Bench Telecom (AA run)94.293
τ³-Bench15.317.9

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.