VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

HealthBench

17 models tracked

HealthBench (OpenAI medical-dialogue benchmark) — Default score; same range as 'no tools' variant but broader model set, not proven same axis.

#ModelVendorBest scoreRunsLast seen
1GPT-5OpenAI67.212026-05-15
2Opus 5Anthropic67.112026-07-29
3Claude Mythos 5Anthropic62.722026-06-12
4Qwen3.8 Max PreviewAlibaba60.222026-08-23
5Claude Opus 4.8Anthropic59.322026-08-12
6Kimi K2 (Reasoning)Moonshot5822026-05-15
7GPT OSS 120BOpenAI57.622026-08-23
8GPT-5.6 SolOpenAI5722026-08-23
9GPT-5.6 TerraOpenAI5712026-08-23
10GPT-5.5OpenAI56.512026-06-12
11GPT-5.6 LunaOpenAI55.812026-08-23
12Qwen3.7 MaxAlibaba54.512026-08-12
13GPT-5.5 InstantOpenAI51.412026-08-23
14DeepSeek-V3.2DeepSeek46.912026-05-15
15Claude Sonnet 4.5Anthropic44.212026-05-15
16gpt-oss-20bOpenAI42.512026-08-23
17Qwen3 14B BaseAlibaba0.512026-07-05

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.