VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSeek-R1 vs GPT-5

DeepSeekvsOpenAI44 shared benchmarks341 head-to-head
BenchmarkDeepSeek-R1GPT-5
AA Agentic Index3.149.7
AA Intelligence18.635.3
AA-LCR5676.3
AA-Omniscience-31.3-8.7
aider_polyglot71.688
AIME 202587.595
AIR-Bench 202452.987.7
arc_agi_121.256.2
ARC-AGI-21.37.5
Artificial Analysis Coding Index24.638.9
browsecomp8.954.9
browsecomp_zh35.765
critpt0.65.7
Fortress74.417
gdpval1.532.5
GPQA Diamond8187.3
harmbench54.670
HLE17.728.5
HMMT 202579.493.3
hmmt_feb_202576.788.3
IFBench3973.1
imo_20256.838.1
LiveCodeBench84.485
mmlu_redux93.495.3
MMLU-Pro8587.5
multichallenge4571.1
MultiNRC27.652.1
OmniScience Accuracy30.740.3
OmniScience Non-Hallucination10.521
scicode35.743
simplebench40.856.7
simpleqa_verified27.450.6
SWE-bench Multilingual30.555.3
SWE-bench Verified57.674.9
TauBench V3 - Banking6.422.1
Terminal-Bench5.743.8
Terminal-Bench 2.119.135.2
Terminal-Bench Hard6.137.9
vectara_answer_rate9799.9
vectara_avg_summary_length93.5162.7
vectara_factual_consistency88.785.3
vectara_hallucination_rate11.314.7
τ²-Bench Telecom (AA run)11.486.5
τ³-Bench6.419.6

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.