VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSeek-V3.2 vs GPT-5.2

DeepSeekvsOpenAI63 shared benchmarks954 head-to-head
BenchmarkDeepSeek-V3.2GPT-5.2
AA Agentic Index39.860.2
AA Intelligence32.843.3
AA-LCR70.779.3
AA-Omniscience-22.50.3
AIME 202593.1100
aime_202695.198.3
AIME25 no tools89.398
apexAgents14.523
arc_agi_15786.2
ARC-AGI-2452.9
arena_text_factuality14331442
Artificial Analysis Coding Index44.248.7
browsecomp51.465.8
BrowseComp (context management)67.670
browsecomp_with_context_manager67.665.8
browsecomp_zh6576.1
coding_arena_elo13681418
critpt2.911.6
deepsearchqa_f160.971.3
frontiermath_tier_42.118.8
gaia_level190.392.5
gaia_level273.674.8
gaia_level361.257.1
gaia_overall76.777.4
gdpval18.848.3
GPQA (unspecified)79.992.4
GPQA Diamond8492.4
HLE40.845.5
HLE (with tools)40.845.5
HMMT 202590.299.4
hmmt_feb_202592.5100
hmmt_feb_202684.197
hmmt_nov_202590.299.2
IFBench6175.4
imo_answer_bench78.386.3
LiveCodeBench8689
longbench_v259.854.5
MCP Atlas62.268
MMLU-Pro8687
OmniScience Accuracy3344.3
OmniScience Non-Hallucination17.338.4
PaperBench47.163.7
scicode3952.1
Seal-049.545
simpleqa_verified27.538.9
swe_bench_bash6072.8
SWE-bench Multilingual70.272
SWE-bench Pro15.655.6
SWE-bench Verified73.180
SWE-Perf0.93.6
SWT-bench6280.7
TauBench V3 - Banking18.811.1
Terminal-Bench 2.046.454
Terminal-Bench Hard35.662.2
tool_decathlon35.246.3
toolathlon35.246.3
vectara_answer_rate92.6100
vectara_avg_summary_length62186.3
vectara_factual_consistency93.789.2
vectara_hallucination_rate6.310.8
τ²-Bench9185.5
τ²-Bench Telecom (AA run)90.698.7
τ³-Bench69.212

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.