VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

SWE-bench Pro

76 models tracked

SWE-bench Pro — DeepSeek-card naming "(Resolved)"=standard SWE-bench Pro metric; matches swe_bench_pro range/raws

#ModelVendorBest scoreRunsLast seen
1MAI-Thinking-1Microsoft95.422026-08-23
2Claude Mythos 5Anthropic80.332026-08-23
3Claude Fable 5Anthropic8052026-08-23
4Opus 5Anthropic79.212026-07-24
5Claude Opus 4.8Anthropic69.292026-08-23
6Qwen3.8 Max PreviewAlibaba67.722026-08-23
7Grok4.5SpaceXAI64.722026-08-23
8GPT-5.6 SolOpenAI64.632026-08-23
9Claude Opus 4.7Anthropic64.362026-08-23
10GPT-5.6 TerraOpenAI63.412026-08-23
11Claude Sonnet 5Anthropic63.232026-08-23
12GPT-5.6 LunaOpenAI62.722026-08-23
13GLM-5.2 Full Open SourceZ.ai62.152026-08-23
14Qwen3.8 27BAlibaba61.722026-08-23
15Muse Spark 1.1Meta61.532026-08-23
16Qwen3.7 MaxAlibaba60.642026-08-23
17laguna-s-2.1poolside59.422026-08-23
18GPT-5.4OpenAI59.1132026-08-23
19MiniMax M3MiniMax5932026-08-23
20Gemini 3.6 FlashGoogle58.732026-08-24
21GPT-5.5OpenAI58.682026-08-23
22Kimi K2.6Moonshot58.682026-08-23
23GLM-5.1Z.ai58.492026-08-23
24ClaudesAnthropic58.112026-08-12
25Claude Sonnet 4.6Anthropic58.122026-07-07
26Hunyuan Hy3Tencent57.912026-07-14
27Hy3-previewTencent57.912026-08-23
28Qwen3.7 Plus PreviewAlibaba57.622026-08-23
29Claude Opus 4.6Anthropic57.3112026-08-14
30MiMo V2.5 ProXiaomi57.222026-08-23
31Claude Opus 4.5Anthropic57.152026-07-29
32GPT-5.3 CodexOpenAI56.822026-08-23
33Qwen3.6 PlusAlibaba56.632026-08-23
34GPT-5.2 CodexOpenAI56.432026-08-23
35MiniMax M2.7MiniMax56.232026-08-23
36Inkling-SmallThinking Machines55.912026-08-23
37GPT-5.2OpenAI55.652026-06-21
38DeepSeek-V4-ProDeepSeek55.4122026-08-23
39MiniMax M2.5MiniMax55.412026-08-23
40GLM-5Z.ai55.122026-05-18
41Gemini 3.5 FlashGoogle55.162026-08-24
42Muse SparkMeta5532026-08-23
43GPT-5.4 miniOpenAI54.412026-08-23
44Gemini 3.5 Flash LiteGoogle54.252026-08-24
45Gemini 3.1 ProGoogle54.2192026-08-24
46Kimi K2.5Moonshot53.852026-08-23
47Qwen3.6 27BAlibaba53.532026-08-23
48DeepSeek-V4-FlashDeepSeek52.642026-06-27
49GPT-5.4 nanoOpenAI52.412026-08-23
50muse-glimmer-30bMeta51.222026-08-23
51Qwen3.5 27BAlibaba51.222026-06-15
52MAI-Code-1-FlashMicrosoft51.222026-08-23
53Qwen3.5 397B A17BAlibaba50.912026-06-15
54Gemini 3 Flash PreviewGoogle49.672026-08-04
55Qwen3.6 35B A3BAlibaba49.532026-08-23
56Laguna-XS-2.1poolside47.612026-08-23
57Qwen3.5 35B A3BAlibaba44.612026-05-03
58Claude Sonnet 4.5Anthropic43.622026-06-01
59Gemini 3 ProGoogle43.332026-06-01
60Claude Sonnet 4Anthropic42.732026-06-23
61GPT-5OpenAI41.812026-05-02
62North-Mini-Code-1.0Cohere40.212026-08-23
63Claude Haiku 4.5Anthropic39.532026-06-19
64Qwen3 Coder 480B A35B InstructAlibaba38.732026-06-19
65MiniMax M2.1MiniMax36.822026-06-01
66Gemma 4 31BGoogle35.722026-06-15
67Kimi K2 InstructMoonshot27.722026-06-01
68Qwen3 235B A22BAlibaba21.442026-06-20
69GPT OSS 120BOpenAI16.232026-06-21
70DeepSeek-V3.2DeepSeek15.622026-06-01
71Gemma 4 26B A4BGoogle13.812026-05-03
72Gemma 3 27BGoogle11.422026-06-01
73Llama 3.1 Instruct 405BMeta11.232026-06-19
74GLM-4.6Z.ai9.742026-06-20
75Llama 4 MaverickMeta5.222026-06-01
76Codestral 2405Mistral1.522026-06-01

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.