VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-5 vs GPT-5.2

OpenAIvsOpenAI66 shared benchmarks1650 head-to-head
BenchmarkGPT-5GPT-5.2
AA Agentic Index49.760.2
AA Intelligence35.343.3
AA-LCR76.379.3
AA-Omniscience-8.70.3
AIME 202595100
AIME25 no tools94.698
arc_agi_156.286.2
ARC-AGI-27.552.9
arena_vision12121245
Artificial Analysis Coding Index38.948.7
browsecomp54.965.8
browsecomp_zh6576.1
coding_arena_elo14191418
critpt5.711.6
Fortress1717.5
frontiermath_tier_412.518.8
gaia_level178.592.5
gaia_level264.874.8
gaia_level346.957.1
gaia_overall66.177.4
gdpval32.548.3
GPQA (unspecified)85.792.4
GPQA Diamond87.392.4
HealthBench Consensus length-adjusted95.694.4
HealthBench Hard length-adjusted34.734.3
HealthBench Professional length-adjusted46.245.9
healthbench_length_adjusted57.756.8
HLE28.545.5
HLE (with tools)35.245.5
HMMT 202593.399.4
hmmt_feb_202588.3100
hmmt_nov_202589.299.2
IFBench73.175.4
imo_answer_bench7686.3
LiveCodeBench8589
matharena_visual_math_overall78.886.5
metr_hcast68.477
metr_re_bench4035
metr_swaa10099.6
MMLU-Pro87.587
MMMU-Pro78.479.5
MultiNRC52.142.2
ocrbench_v255.550.5
OmniScience Accuracy40.344.3
OmniScience Non-Hallucination2138.4
scicode4352.1
SEAL VISTA49.746.6
Seal-051.445
simplebench56.745.8
simpleqa_verified50.638.9
swe_bench_bash6572.8
SWE-bench Multilingual55.372
SWE-bench Pro41.855.6
SWE-bench Verified74.980
Tau2 retail81.182
TauBench V3 - Banking22.111.1
Terminal-Bench 2.035.254
Terminal-Bench Hard37.962.2
vectara_answer_rate99.9100
vectara_avg_summary_length162.7186.3
vectara_factual_consistency85.389.2
vectara_hallucination_rate14.710.8
VideoMMMU84.685.9
τ²-Bench8585.5
τ²-Bench Telecom (AA run)86.598.7
τ³-Bench19.612

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.