VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Opus 4.7 vs Gemini 3 Pro

AnthropicvsGoogle46 shared benchmarks3412 head-to-head
BenchmarkClaude Opus 4.7Gemini 3 Pro
AA Agentic Index64.652
AA Intelligence5540.6
AA-LCR75.373
AA-Omniscience27.315.3
aime_202695.891.7
arc_agi_19275
ARC-AGI-275.854
arena_elo14941485
arena_text_factuality14741481
arena_vision13041290
Artificial Analysis Coding Index73.646.5
browsecomp79.859.2
charxiv_rq82.181.4
coding_arena_elo15571438
critpt129.1
cybergym73.839.9
frontiermath_tier_422.918.8
gdpval58.634.2
GDPval-AA (Elo)17531195
GPQA Diamond94.291.9
HLE54.745.8
HLE (with tools)54.745.8
hmmt_feb_202693.986.4
IFBench58.670.4
livebench76.973.4
MCP Atlas79.170.3
mmmlu91.591.8
MMMU-Pro78.881
mrcr_v2_8needle_128k_average59.377
OmniScience Accuracy48.955.8
OmniScience Non-Hallucination57.710
scicode54.556.1
screenspot_pro_no_tools79.572.7
simplebench61.776.4
simpleqa_verified50.672.9
SWE-bench Multilingual80.568.7
SWE-bench Pro64.343.3
SWE-bench Verified87.678
Terminal-Bench 2.069.454.2
Terminal-Bench Hard54.556.9
toolathlon59.336.4
vectara_answer_rate9899.4
vectara_avg_summary_length149.1101.9
vectara_factual_consistency8886.4
vectara_hallucination_rate1213.6
τ²-Bench Telecom (AA run)88.698

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.