Pro Mode — raw scores, one benchmark under the lensthird-party eval harness
The field · 114 measured
1,078.911,813.6
114 models measured, most on the third-party eval harness. Claude Opus 5.5 tops the board at 1,813.6.
114 measured·2 new this week·Lifecycle Updated Oct 9, 2026Score basis
#◆Vendor$/M in$/M out
Leader — ignites whiteField — fill cools with scoreBars show 1,078.91–1,813.6 · ◆ solid = first-party or better · outlined = arm's-length
03Sonnet 5.5NEW+1 altAAnthropic1,772.75$2.0/M$10.0/M$0.003 07GPT-6 SolOOpenAI1,687.49$2.0/M$10.0/M$0.004 11Kimi K3+1 altKMoonshot1,655.02$0.58/M$12.3/M$0.004 12Grok 4.7SSpaceXAI1,638.05$2.0/M$6.0/M$0.002 15Hy4TTencent1,631.72$0.83/M$2.5/M$0.001 18GLM-5.3ZZ.ai1,622.27$1.4/M$4.4/M$0.002 21Grok 4.6SSpaceXAI1,616.96$2.0/M$6.0/M$0.002 23GLM-5.2ZZ.ai1,602.95$1.4/M$4.4/M$0.002 31Grok4.5SSpaceXAI1,552.85$2.0/M$6.0/M$0.003 43GPT-5.5+2 altsOOpenAI1,512.71$5.0/M$30.0/M$0.012 44Kimi K2.6KMoonshot1,509.12$0.95/M$4.0/M$0.002 45GLM-5.1ZZ.ai1,508.21$1.4/M$4.4/M$0.002 53GPT-5.4+2 altsOOpenAI1,465.23$2.5/M$15.0/M$0.006 60MiMo V2.5XXiaomi1,438.14$0.14/M$0.28/M$0.000 61Kimi K2.5KMoonshot1,436.41$0.45/M$2.3/M$0.001 62GLM-4.7ZZ.ai1,435.07$0.60/M$2.2/M$0.001 63GLM-5ZZ.ai1,434.45$1.0/M$3.2/M$0.001 66GPT-5OOpenAI1,417.82$1.3/M$10.0/M$0.004 67GPT-5.2OOpenAI1,416.07$1.8/M$14.0/M$0.006 68InklingTMThinking Machines1,412.18$0.95/M$4.0/M$0.002 76GPT-5.1+2 altsOOpenAI1,395.2$1.3/M$10.0/M$0.004 89Grok 4.3SSpaceXAI1,357.02$1.3/M$2.5/M$0.001 90Laguna M.1Ppoolside1,347.25$0.20/M$0.40/M$0.000 91GLM-4.6ZZ.ai1,340.6$0.57/M$2.2/M$0.001 110Devstral 2+1 altMIMistral1,193.87$0.40/M$2.0/M$0.001 111Mercury 2IInception1,166.43$0.25/M$0.75/M$0.000