VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.6 vs Gemini 2.5 Pro

AnthropicvsGoogle44 shared benchmarks368 head-to-head
BenchmarkClaude Opus 4.6Gemini 2.5 Pro
AA Agentic Index67.67.2
AA Intelligence44.927
AA-LCR74.366
AA-Omniscience13.7-14.3
AIME 202599.888.3
arc_agi_19341
ARC-AGI-268.84.9
arena_elo14971446
arena_text_factuality14871462
arena_vision13001246
Artificial Analysis Coding Index48.146.7
browsecomp86.89.9
coding_arena_elo15451224
critpt12.62.6
Fortress20.554.9
frontiermath_tier_422.94.2
gdpval55.98.5
GPQA Diamond91.384.4
HLE53.122.5
HLE (with tools)62.728.4
hmmt_nov_202596.380
IFBench62.549
LiveCodeBench88.882.7
matharena_visual_math_overall72.377.2
mathvision71.273.3
MMLU-Pro89.186
MMMU-Pro77.374.9
multichallenge5653.6
ocrbench_v248.459.3
OmniScience Accuracy4739
OmniScience Non-Hallucination37.212.6
scicode5243
SEAL VISTA46.150.8
simplebench67.662.4
simpleqa_verified46.556
swe_bench_bash75.653.6
SWE-bench Verified80.867.2
Terminal-Bench Hard65.426.5
vectara_answer_rate99.899.1
vectara_avg_summary_length137.6106.4
vectara_factual_consistency87.893
vectara_hallucination_rate12.27
τ²-Bench Telecom (AA run)99.354.1
τ³-Bench72.49.3

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.