VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

swe_bench_bash

40 models tracked

SWE-bench Bash Only — Official SWE-bench "Bash Only" agentless split, swe_bench_official source

#ModelVendorBest scoreRunsLast seen
1Claude Opus 4.5Anthropic76.842026-08-10
2MiniMax M2.5MiniMax75.812026-05-01
3Gemini 3 Flash PreviewGoogle75.822026-05-30
4Claude Opus 4.6Anthropic75.612026-05-01
5Gemini 3 ProGoogle74.222026-05-01
6GPT-5.2 CodexOpenAI72.812026-05-01
7GPT-5.2OpenAI72.842026-08-10
8GLM-5Z.ai72.812026-05-01
9Claude Sonnet 4.5Anthropic71.462026-08-10
10Kimi K2.5Moonshot70.812026-05-01
11Claude 4 OpusAnthropic67.612026-05-01
12Claude Haiku 4.5Anthropic66.612026-05-01
13GPT-5.1 CodexOpenAI6622026-05-30
14GPT-5.1OpenAI6642026-06-21
15GPT-5OpenAI6532026-08-10
16Claude Sonnet 4Anthropic64.912026-05-01
17Kimi K2 (Reasoning)Moonshot63.412026-05-01
18MiniMax M2MiniMax6112026-05-01
19DeepSeek-V3.2DeepSeek6012026-05-01
20GPT-5 miniOpenAI59.822026-05-01
21o3OpenAI58.412026-05-01
22Qwen3 Coder 480B A35B InstructAlibaba55.422026-06-19
23GLM-4.6Z.ai55.412026-05-01
24GLM-4.5Z.ai54.212026-05-01
25Devstral 2512Mistral53.812026-05-01
26Gemini 2.5 ProGoogle53.612026-05-01
27Claude 3.7 SonnetAnthropic52.822026-06-21
28o4-miniOpenAI4512026-05-01
29Kimi K2 InstructMoonshot43.812026-05-01
30GPT-4.1OpenAI39.612026-05-01
31GPT-5 nanoOpenAI34.812026-05-01
32Gemini 2.5 FlashGoogle28.712026-05-01
33GPT OSS 120BOpenAI2612026-05-01
34GPT-4.1 miniOpenAI23.922026-06-19
35GPT-4oOpenAI21.612026-05-01
36Llama 4 MaverickMeta2112026-05-01
37Gemini 2.0 Flash (Reasoning)Google13.512026-06-24
38Gemini 2.0 Flash (Non-Reasoning)Google13.512026-05-01
39Llama 4 ScoutMeta9.112026-05-01
40Qwen 2.5 Coder 32B InstructAlibaba912026-05-01

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.