VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.5 vs Gemini 2.5 Pro

AnthropicvsGoogle47 shared benchmarks3412 head-to-head
BenchmarkClaude Opus 4.5Gemini 2.5 Pro
AA Agentic Index59.67.2
AA Intelligence41.927
AA-LCR7666
AA-Omniscience14-14.3
AIME 202592.888.3
arc_agi_18241
ARC-AGI-237.64.9
arena_elo14731446
arena_text_factuality14581462
Artificial Analysis Coding Index47.846.7
browsecomp379.9
browsecomp_zh62.432.2
coding_arena_elo14951224
critpt4.62.6
Fortress13.654.9
frontiermath_tier_44.24.2
gdpval47.38.5
GPQA Diamond8784.4
HLE30.822.5
HLE (with tools)43.428.4
hmmt_feb_202592.982.5
hmmt_nov_202593.380
IFBench5849
LiveCodeBench8782.7
mathvision77.173.3
MathVista80.283.9
MMLU-Pro9086
MMMU80.783.9
MMMU-Pro7474.9
MMStar73.279.2
multichallenge5953.6
OCRBench86.585.9
OmniScience Accuracy46.639
OmniScience Non-Hallucination3912.6
scicode5043
SEAL VISTA46.450.8
simplebench6262.4
simpleqa_verified41.856
swe_bench_bash76.853.6
SWE-bench Verified81.567.2
Terminal-Bench Hard4726.5
vectara_answer_rate98.799.1
vectara_avg_summary_length114.5106.4
vectara_factual_consistency89.193
vectara_hallucination_rate10.97
τ²-Bench98.254
τ²-Bench Telecom (AA run)89.554.1

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.