VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

Claude Sonnet 4.6 vs Gemini 3 Pro

AnthropicvsGoogle41 shared benchmarks2516 head-to-head
BenchmarkClaude Sonnet 4.6Gemini 3 Pro
AA Agentic Index61.652
AA Intelligence48.440.6
AA-LCR7473
AA-Omniscience12.215.3
apexAgents2818.4
arc_agi_186.575
ARC-AGI-260.454
arena_elo14721485
arena_text_factuality14601481
arena_vision12781290
Artificial Analysis Coding Index6346.5
browsecomp76.259.2
charxiv_rq72.481.4
coding_arena_elo15231438
critpt3.19.1
frontiermath_tier_48.318.8
gdpval54.834.2
GDPval-AA (Elo)16761195
GPQA Diamond89.991.9
HLE4945.8
HLE (with tools)46.845.8
IFBench56.670.4
livebench75.573.4
MCP Atlas69.570.3
mmmlu89.391.8
MMMU-Pro75.681
mrcr_v2_8needle_128k_average84.977
OmniScience Accuracy40.955.8
OmniScience Non-Hallucination51.610
scicode4756.1
simpleqa_verified2972.9
SWE-bench Pro58.143.3
SWE-bench Verified79.678
Terminal-Bench 2.059.154.2
Terminal-Bench Hard59.156.9
toolathlon49.436.4
vectara_answer_rate99.999.4
vectara_avg_summary_length114.7101.9
vectara_factual_consistency89.486.4
vectara_hallucination_rate10.613.6
τ²-Bench Telecom (AA run)97.998

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.