VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-5.2 vs o3

OpenAIvsOpenAI39 shared benchmarks336 head-to-head
BenchmarkGPT-5.2o3
AA Agentic Index60.236.1
AA Intelligence43.331.1
AA-LCR79.373.3
AA-Omniscience0.3-15.3
AIME 202510089.2
arc_agi_186.260.8
ARC-AGI-252.96.5
arena_vision12451217
Artificial Analysis Coding Index48.738.4
browsecomp65.849.7
critpt11.61.1
Fortress17.516
frontiermath_tier_418.82.1
gdpval48.312.8
GPQA Diamond92.483.3
HLE45.520.3
hmmt_feb_202510077.5
IFBench75.471.4
LiveCodeBench8984.7
longbench_v254.558.8
MathVista82.886.8
metr_hcast7764.7
metr_re_bench3515
metr_swaa99.699.8
MMLU-Pro8785
MMMU-Pro79.576.4
MultiNRC42.245.5
OmniScience Accuracy44.338.6
OmniScience Non-Hallucination38.412.9
PropensityBench34.410.5
scicode52.141
simplebench45.853.1
simpleqa_verified38.953
swe_bench_bash72.858.4
SWE-bench Verified8069.1
Tau2 retail8280.2
Terminal-Bench Hard62.237.1
VideoMMMU85.983.3
τ²-Bench Telecom (AA run)98.780.7

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.