VECTOR WIREAI INTELLIGENCE
NVDA$1,847+3.2%MSFT$512+1.1%GOOGL$199-0.4%META$728+2.7%AMD$184-1.2%TSM$212+0.6%PLTR$98+4.1%AI IDX4,821+1.9%
PKT
SEEDRefresh Models Deals Regulatory Sources

aider_polyglot

59 models tracked

Aider Polyglot — Well-known cross-language coding benchmark from the Aider project

#ModelVendorBest scoreRunsLast seen
1GPT-5OpenAI8842026-08-23
2o3-proOpenAI84.912026-05-01
3Gemini 2.5 ProGoogle82.242026-08-23
4Gemini 2.5 Pro Preview 06.05 (32k think)Google82.222026-08-24
5o3OpenAI81.322026-08-23
6Grok 4SpaceXAI79.612026-05-01
7DeepSeek-V3.1DeepSeek76.332026-08-23
8DeepSeek-V3.2-ExpDeepSeek74.532026-08-23
9o4-miniOpenAI7222026-08-23
10DeepSeek-R1DeepSeek71.6152026-08-23
11Claude Sonnet 4Anthropic70.732026-06-15
12Claude 4 OpusAnthropic70.732026-06-15
13o3-miniOpenAI66.732026-08-23
14Claude 3.7 SonnetAnthropic64.932026-06-20
15Gemini 2.5 FlashGoogle61.942026-08-23
16Qwen3 235B A22BAlibaba61.822026-06-15
17Qwen3 Coder 480B A35B InstructAlibaba61.812026-08-23
18o1OpenAI61.762026-06-04
19Kimi K2 InstructMoonshot6042026-08-23
20Kimi K2 (Reasoning)Moonshot59.112026-05-01
21Qwen3 235B A22B Instruct 2507Alibaba57.312026-08-23
22Claude Sonnet 4-20250514 (no thinking)Anthropic56.412026-06-20
23DeepSeek-V3DeepSeek55.1122026-08-23
24Grok 3 BetaSpaceXAI53.312026-05-01
25GPT-4.1OpenAI52.432026-08-23
26Qwen3 Next 80B A3B InstructAlibaba49.812026-08-23
27DeepSeek-Chat-V3 (prev)DeepSeek48.412026-05-01
28Magistral Medium 1Mistral47.112026-08-23
29Claude 3.5 SonnetAnthropic45.362026-06-04
30chatgpt-4o-latest-20250326OpenAI45.322026-05-01
31GPT-4.5 PreviewOpenAI44.912026-05-01
32GPT OSS 120BOpenAI41.812026-05-01
33Qwen3 32BAlibaba4012026-05-01
34Gemini Exp 1206Google38.212026-05-01
35Gemini 2.0 Pro Exp 02.05Google35.612026-05-01
36Grok 3 Mini BetaSpaceXAI34.722026-05-01
37GPT-4.1 miniOpenAI34.732026-08-23
38OpenAI o1-miniOpenAI32.962026-06-04
39GPT-4oOpenAI30.792026-08-23
40Claude 3.5 HaikuAnthropic2822026-06-19
41Gemini 2.5 Flash LiteGoogle26.712026-08-23
42Gemini 2.0 Flash ExpGoogle22.212026-05-01
43Qwen MaxAlibaba21.812026-05-01
44QwQ 32B PreviewAlibaba20.912026-05-01
45Gemini 2.0 Flash Thinking Exp 01.21Google18.212026-05-01
46DeepSeek-V2.5DeepSeek18.212026-05-03
47DeepSeek-Chat-V2.5DeepSeek17.812026-05-01
48Gemini 1.5 ProGoogle16.912026-05-03
49Llama 4 MaverickMeta15.612026-05-01
50Yi Lightning01.AI12.912026-05-01
51R1-ZeroDeepSeek12.212026-05-03
52Command A 03-2025 QualityCohere1212026-05-01
53Codestral 25.01Mistral11.112026-05-01
54GPT-4.1 nanoOpenAI9.832026-08-23
55Qwen 2.5 Coder 32B InstructAlibaba812026-05-01
56Qwen2.5 Instruct 72BAlibaba7.612026-05-03
57Llama 3.1 Instruct 405BMeta5.812026-05-03
58Gemma 3 27BGoogle4.912026-05-01
59GPT-4o miniOpenAI3.612026-05-01

Best tracked score per model (default configuration; source-attributed and verification-tiered). Open a model for its full benchmark surface, provenance and pricing.