VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSeek-V3 vs Gemini 2.5 Pro

DeepSeekvsGoogle42 shared benchmarks438 head-to-head
BenchmarkDeepSeek-V3Gemini 2.5 Pro
AA Agentic Index1.67.2
AA Intelligence15.427
AA-LCR41.366
AA-Omniscience-37.6-14.3
aider_polyglot55.182.2
AIME 202551.388.3
AIR-Bench 202440.873.6
anthropic_red_team97.199.5
Artificial Analysis Coding Index2346.7
bbq96.796.4
critpt02.6
gdpval08.5
GPQA Diamond68.484.4
harmbench49.765.4
HLE5.222.5
HMMT 202527.565.7
hmmt_feb_202529.282.5
IFBench4149
LiveCodeBench49.682.7
livecodebench_easy83.398.8
livecodebench_hard14.259.4
livecodebench_medium53.590.6
MMLU-Pro81.286
multichallenge31.453.6
OmniScience Accuracy25.439
OmniScience Non-Hallucination23.312.6
scicode35.843
simple_safety_tests95.397
simplebench27.262.4
simpleqa27.750.8
SWE-bench Verified4267.2
TauBench V3 - Banking4.79.7
Terminal-Bench 2.116.928.5
Terminal-Bench Hard15.226.5
vectara_answer_rate97.599.1
vectara_avg_summary_length81.7106.4
vectara_factual_consistency93.993
vectara_hallucination_rate6.17
xstest97.198.7
τ²-Bench32.554
τ²-Bench Telecom (AA run)47.154.1
τ³-Bench4.79.3

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.