VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

DeepSWE

22 models tracked

DeepSWE — Agentic SWE task-completion benchmark from GLM-5.2 cards

#ModelVendorBest scoreRunsLast seen
1GPT-5.6 SolOpenAI7322026-08-23
2Claude Fable 5Anthropic7012026-07-27
3GPT-5.5OpenAI7032026-07-27
4GPT-5.6 TerraOpenAI69.612026-08-23
5Kimi K3Moonshot67.542026-08-23
6GPT-5.6 LunaOpenAI67.212026-08-23
7DeepSeek-V4-Flash-Vision-ExpDeepSeek59.312026-08-23
8Claude Opus 4.8Anthropic5952026-08-13
9DeepSeek-V4-FlashDeepSeek54.462026-08-23
10Grok4.5SpaceXAI5312026-08-23
11Gemini 3.6 FlashGoogle4932026-08-04
12GLM-5.2 Full Open SourceZ.ai46.272026-08-23
13laguna-s-2.1poolside40.412026-07-23
14Gemini 3.5 Flash CyberGoogle3712026-08-04
15Gemini 3.5 FlashGoogle3712026-08-04
16Gemini 3.5 Flash LiteGoogle3712026-08-04
17Hy3-previewTencent2812026-08-23
18MiniMax M3MiniMax2022026-07-13
19GLM-5.1Z.ai1822026-07-13
20Qwen3.7 MaxAlibaba1822026-07-17
21DeepSeek-V4-ProDeepSeek12.842026-08-13
22Gemini 3.1 ProGoogle1022026-07-13

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.