VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.8 vs Claude Sonnet 4.5

AnthropicvsAnthropic45 shared benchmarks432 head-to-head
BenchmarkClaude Opus 4.8Claude Sonnet 4.5
AA Agentic Index49.450.6
AA Intelligence57.337.4
AA-LCR7368.3
AA-Omniscience28.8-0.1
arc_agi_192.563.7
ARC-AGI-272.113.6
arena_elo14821456
arena_text_factuality14641448
Artificial Analysis Coding Index74.352.1
browsecomp88.524.1
charxiv_rq80.567.2
coding_arena_elo15391392
critpt20.91.1
Fortress18.217
frontiermath_tier_431.34.2
gdpval54.240.4
GPQA Diamond93.683.4
HealthBench59.344.2
HLE57.919.8
HLE (with tools)57.932
hmmt_nov_202596.581.7
IFBench62.257.3
imo_answer_bench83.565.9
longbench_v269.161.8
matharena_visual_math_overall81.675.8
MCP Atlas83.659.5
MMMU-Pro78.968.7
OmniScience Accuracy48.832.9
OmniScience Non-Hallucination60.750.9
OSWorld-Verified83.461.4
scicode53.545
simplebench64.854.3
simpleqa_verified39.523.6
SWE-bench Multilingual84.468
SWE-bench Pro69.243.6
SWE-bench Verified88.682
TauBench V3 - Banking34.224.5
Terminal-Bench 2.074.650
Terminal-Bench 2.18555.8
Terminal-Bench Hard58.335.6
toolathlon59.941
Toolathlon Avg turns24.532
Toolathlon Pass@∞48.128.7
τ²-Bench Telecom (AA run)94.478.1
τ³-Bench27.619

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.