VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSeek-V3.2 vs Gemma 4 31B

DeepSeekvsGoogle43 shared benchmarks3210 head-to-head
BenchmarkDeepSeek-V3.2Gemma 4 31B
AA Agentic Index39.814.4
AA Intelligence32.829.7
AA-LCR70.768.3
AA-Omniscience-22.5-47.9
aime_202695.189.2
arena_text_factuality14331449
Artificial Analysis Coding Index44.243.4
coding_arena_elo13681364
critpt2.91.4
gdpval18.815.5
GPQA (unspecified)79.984.3
GPQA Diamond8485.7
HLE40.826.5
HLE (with tools)40.826.5
hmmt_feb_202592.588.7
hmmt_feb_202684.177.2
hmmt_nov_202590.287.5
IFBench6175.6
imo_answer_bench78.374.5
LiveCodeBench v683.380
MCP Atlas62.257.2
mcpmark3818.1
mmlu_redux93.793.7
MMLU-Pro8685.2
OmniScience Accuracy3320
OmniScience Non-Hallucination17.318.1
scicode3943.4
simpleqa_verified27.59.6
SWE-bench Multilingual70.251.7
SWE-bench Pro15.635.7
SWE-bench Verified73.152
TauBench V3 - Banking18.814.8
Terminal-Bench 2.046.442.9
Terminal-Bench 2.146.843.4
Terminal-Bench Hard35.636.4
tool_decathlon35.221.2
vectara_answer_rate92.6100
vectara_avg_summary_length6275.8
vectara_factual_consistency93.792.6
vectara_hallucination_rate6.37.4
τ²-Bench9176.9
τ²-Bench Telecom (AA run)90.665.5
τ³-Bench69.267.5

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.