VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Sonnet 4 vs GPT-5.6 Sol

AnthropicvsOpenAI25 shared benchmarks124 head-to-head
BenchmarkClaude Sonnet 4GPT-5.6 Sol
AA Agentic Index39.257.8
AA Intelligence29.861
AA-LCR69.777.7
AA-Omniscience0.222
arc_agi_163.797.5
ARC-AGI-213.692.5
Artificial Analysis Coding Index37.678.3
browsecomp12.290.4
critpt1.132.3
gdpval31.261.1
GPQA Diamond7894.6
HLE10.749.5
HLE (with tools)20.358
IFBench5572.7
MMMU-Pro62.484.6
OmniScience Accuracy22.759.4
OmniScience Non-Hallucination70.910.6
OSWorld-Verified42.283
scicode4056.9
simplebench45.564.8
SWE-bench Pro42.764.6
TauBench V3 - Banking16.744.3
Terminal-Bench 2.136.389.5
Terminal-Bench Hard31.165.9
τ²-Bench Telecom (AA run)64.685.1

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.