VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

GPT-5 vs GPT-5.5

OpenAIvsOpenAI43 shared benchmarks735 head-to-head
BenchmarkGPT-5GPT-5.5
AA Agentic Index49.747.4
AA Intelligence35.356.3
AA-LCR76.379
AA-Omniscience-8.720.5
arc_agi_156.295
ARC-AGI-27.585
arena_vision12121283
Artificial Analysis Coding Index38.974.9
browsecomp54.984.4
coding_arena_elo14191457
critpt5.727.1
Fortress1716.3
frontiermath_tier_412.535.4
gdpval32.549.5
GPQA Diamond87.393.6
HealthBench67.256.5
HealthBench Consensus length-adjusted95.695.6
HealthBench Hard length-adjusted34.731.5
HealthBench Professional length-adjusted46.251.8
healthbench_length_adjusted57.756.5
HLE28.552.2
HLE (with tools)35.252.2
hmmt_nov_202589.296.5
IFBench73.175.9
matharena_visual_math_overall78.894.9
MMMU-Pro78.483.2
OmniScience Accuracy40.358
OmniScience Non-Hallucination2112
scicode4356.1
simplebench56.769
simpleqa_verified50.663.1
SWE-bench Pro41.858.6
SWE-bench Verified74.980.6
TauBench V3 - Banking22.139
Terminal-Bench 2.035.282.7
Terminal-Bench 2.135.284.3
Terminal-Bench Hard37.960.6
vectara_answer_rate99.9100
vectara_avg_summary_length162.7129.6
vectara_factual_consistency85.390.7
vectara_hallucination_rate14.79.3
τ²-Bench Telecom (AA run)86.593.9
τ³-Bench19.631.3

Best tracked score per model per benchmark (default configuration; source-attributed). ↓ marks lower-is-better metrics. Open either model for its full surface, provenance and pricing.