VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.5 vs Gemini 3 Pro

AnthropicvsGoogle97 shared benchmarks4253 head-to-head
BenchmarkClaude Opus 4.5Gemini 3 Pro
AA Agentic Index59.652
AA Intelligence41.940.6
AA-LCR7673
AA-Omniscience1415.3
AIME 202592.8100
AIME 2026 I93.390.6
aime_202695.191.7
AIME25 no tools9196
arc_agi_18275
ARC-AGI-237.654
ARC-AGI-2 (Verified)37.631.1
arena_elo14731485
arena_text_factuality14581481
Artificial Analysis Coding Index47.846.5
browsecomp3759.2
BrowseComp (context management)59.267.6
browsecomp_with_context_manager67.859.2
browsecomp_zh62.466.8
charxiv_rq68.581.4
coding_arena_elo14951438
critpt4.69.1
cybergym50.639.9
deepsearchqa_f176.163.2
FinSearchCompT2&T366.249.9
Fortress13.641.7
frontiermath_tier_44.218.8
gdpval47.334.2
GPQA Diamond8791.9
HLE30.845.8
HLE (with tools)43.445.8
hmmt_feb_202592.997.5
hmmt_feb_202685.386.4
hmmt_nov_202593.393.3
IFBench5870.4
imo_answer_bench8483.3
InfoVQA (val)76.957.2
livebench7673.4
LiveCodeBench8792
LiveCodeBench v684.890.7
longbench_v264.468.2
LongVideoBench67.277.7
mathvision77.186.1
MathVista80.289.8
MCP Atlas69.870.3
metr_hcast73.471.3
metr_re_bench4035
metr_swaa99.599.5
MLVU81.780.7
MMLU-Pro9090.1
mmmlu90.891.8
MMMU-Pro7481
MMVU77.378.9
MotionBench60.370.3
Multi-SWE-Bench5042.7
multichallenge5965.7
MultiNRC48.659
OCRBench86.590.3
OctoCodingbench36.222.9
OJ-Bench (cpp)54.668.5
OJBench (cpp)54.668.5
OmniDocBench 1.587.788.5
OmniScience Accuracy46.655.8
OmniScience Non-Hallucination3910
scicode5056.1
SEAL VISTA46.451.5
Seal-047.745.5
simplebench6276.4
simpleqa_verified41.872.9
SimpleVQA69.769.7
swe_bench_bash76.874.2
SWE-bench Multilingual77.568.7
SWE-bench Pro57.143.3
SWE-bench Verified81.578
SWE-Perf4.76.5
SWT-bench80.279.7
Terminal-Bench 2.059.354.2
Terminal-Bench Hard4756.9
tool_decathlon43.536.4
toolathlon43.536.4
vectara_answer_rate98.799.4
vectara_avg_summary_length114.5101.9
vectara_factual_consistency89.186.4
vectara_hallucination_rate10.913.6
VIBE (Average)90.782.4
VIBE-Android92.278.7
VIBE-Backend9878.7
VIBE-iOS9075.8
VIBE-Simulation8489.2
VIBE-Web89.189.5
VideoMMMU84.487.6
WideSearch (item-f1)76.257
WorldVQA36.847.4
ZeroBench38
ZeroBench (w/ tools)912
τ²-Bench98.298
τ²-Bench (Retail)88.985.3
τ²-Bench Telecom (AA run)89.598

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.