VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Sonnet 4.5 vs Qwen3.5 27B

AnthropicvsAlibaba52 shared benchmarks2230 head-to-head
BenchmarkClaude Sonnet 4.5Qwen3.5 27B
AA Agentic Index50.654.6
AA Intelligence37.434.6
AA-LCR68.372.3
AA-Omniscience-0.1-44
AI2D8792.9
Artificial Analysis Coding Index52.134.9
browsecomp24.161
browsecomp_zh42.462.1
CC-OCR68.181
charxiv_rq67.279.5
coding_arena_elo13921357
critpt1.10.9
gdpval40.433
GPQA Diamond83.485.8
HallusionBench59.970
HLE19.848.5
HMMT 202574.689.8
hmmt_feb_202579.292
hmmt_nov_202581.789.8
IFBench57.376.5
imo_answer_bench65.979.9
LiveCodeBench v66480.7
longbench_v261.860.6
MathVista79.887.8
MCP Atlas59.568.4
MMBench EN-DEV-v1.188.392.6
mmlu_redux95.693.2
MMLU-Pro88.286.1
mmmlu89.185.9
MMMU79.682.3
MMMU-Pro68.775
multichallenge55.360.8
OmniDocBench 1.585.888.9
OmniScience Accuracy32.920.7
OmniScience Non-Hallucination50.924.9
OSWorld-Verified61.456.2
RealWorldQA70.383.7
scicode4539.5
Seal-053.447.2
SimpleVQA57.656
SWE-bench Multilingual6869.3
SWE-bench Pro43.651.2
SWE-bench Verified8275
Terminal-Bench 2.05041.6
Terminal-Bench Hard35.632.6
vectara_answer_rate95.699.8
vectara_avg_summary_length127.894.4
vectara_factual_consistency8887.9
vectara_hallucination_rate1212.1
ZEROBench_sub26.336.2
τ²-Bench Telecom (AA run)78.193.9
τ³-Bench1968.4

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.