VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.5 vs GPT-5

AnthropicvsOpenAI58 shared benchmarks3324 head-to-head
BenchmarkClaude Opus 4.5GPT-5
AA Agentic Index59.649.7
AA Intelligence41.935.3
AA-LCR7676.3
AA-Omniscience14-8.7
AIME 202592.895
AIME25 no tools9194.6
arc_agi_18256.2
ARC-AGI-237.67.5
Artificial Analysis Coding Index47.838.9
browsecomp3754.9
browsecomp_zh62.465
coding_arena_elo14951419
critpt4.65.7
ERQA46.865.7
Fortress13.617
frontiermath_tier_44.212.5
gdpval47.332.5
GPQA Diamond8787.3
HLE30.828.5
HLE (with tools)43.435.2
hmmt_feb_202592.988.3
hmmt_nov_202593.389.2
IFBench5873.1
imo_answer_bench8476
LiveCodeBench8785
LiveCodeBench v684.887
metr_hcast73.468.4
metr_re_bench4040
metr_swaa99.5100
mmlu_redux95.695.3
MMLU-Pro9087.5
MMMU80.784.2
MMMU-Pro7478.4
Multi-SWE-Bench5039.3
multichallenge5971.1
MultiNRC48.652.1
OJ-Bench (cpp)54.656.2
OmniScience Accuracy46.640.3
OmniScience Non-Hallucination3921
scicode5043
SEAL VISTA46.449.7
Seal-047.751.4
simplebench6256.7
simpleqa_verified41.850.6
swe_bench_bash76.865
SWE-bench Multilingual77.555.3
SWE-bench Pro57.141.8
SWE-bench Verified81.574.9
Tau2 retail88.981.1
Terminal-Bench 2.059.335.2
Terminal-Bench Hard4737.9
vectara_answer_rate98.799.9
vectara_avg_summary_length114.5162.7
vectara_factual_consistency89.185.3
vectara_hallucination_rate10.914.7
VideoMMMU84.484.6
τ²-Bench98.285
τ²-Bench Telecom (AA run)89.586.5

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.