Benchmark · CodeSettled

Aider polyglot

Aider Polyglot · measures how well AI models can edit code across multiple programming languages using the Aider coding assistant framework.

Updated 2025-12-01
Models tested
54
Top score
88.0
GPT-5
Median
52.0
min 3.6
Top-5 spread
σ 2.2
Competitive

Best score over time · one chart, every benchmark

AIDER POLYGLOT39 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Nov 24Feb 25May 25Aug 25Dec 25RELEASE DATE →benchgecko.ai/benchmark/aider-polyglot · frontier
Frontier on Aider polyglot rose from 61.7 to 88.0 in 8 months · +26.3 points · latest leader GPT-5 from OpenAI.
Pink dots = frontier records · 5 totalClick to open model page

54 models tested · sorted by score

#ModelScore
1OpenAI logoGPT-588.0
2OpenAI logoGPT-5 Chat88.0
3OpenAI logoo3 Pro84.9
4Google DeepMind logoGemini 2.5 Pro83.1
5Google DeepMind logoGemini 2.5 Pro Preview 06-0583.1
6OpenAI logoo381.3
7xAI logoGrok 479.6
8Google DeepMind logoGemini 2.5 Pro Preview 05-0676.9
9DeepSeek logoDeepSeek V3.274.2
10DeepSeek logoDeepSeek V3.2 Exp74.2
11Anthropic logoClaude Opus 472.0
12OpenAI logoo4 Mini72.0
13OpenAI logoo4 Mini High72.0
14DeepSeek logoR1 052871.4
15Anthropic logoClaude 3.7 Sonnet64.9
16OpenAI logoo161.7
17Anthropic logoClaude Sonnet 461.3
18OpenAI logoo3 Mini60.4
19OpenAI logoo3 Mini High60.4
20Alibaba Qwen logoQwen3 235B A22B59.6
21Alibaba Qwen logoQwen3 235B A22B Instruct 250759.6
22moonshotai logoKimi K2 071159.1
23DeepSeek logoR156.9
24DeepSeek logoDeepSeek V3 032455.1
25xAI logoGrok 353.3
26xAI logoGrok 3 Beta53.3
27OpenAI logoGPT-4.152.4
28Anthropic logoClaude 3.5 Sonnet51.6
29xAI logoGrok 3 Mini Beta49.3
30xAI logoGrok-3 mini49.3
31DeepSeek logoDeepSeek V348.4
32Google DeepMind logoGemini 2.5 Flash47.1
33OpenAI logoGPT-4.544.9
34OpenAI logogpt-oss-120b41.8
35OpenAI logogpt-oss-120b (free)41.8
36Alibaba Qwen logoQwen3 32B40.0
37Google DeepMind logoGemini 2.0 Flash38.2
38Google DeepMind logoGemini 2.0 Flash (Dec 2024)38.2
39Google DeepMind logoGemini 2.0 Pro35.6
40OpenAI logoo1-mini32.9
41OpenAI logoGPT-4.1 Mini32.4
42Anthropic logoClaude 3.5 Haiku28.0
43OpenAI logoGPT-4o (2024-08-06)23.1
44OpenAI logoGPT-4o (2024-11-20)23.1
45Alibaba Qwen logoQwen2.5-Max21.8
46Alibaba Qwen logoQwQ 32B20.9
47Google DeepMind logoGemini 2.0 Flash Thinking (Jan 2025)18.2
48Alibaba Qwen logoQwen2.5 Coder 32B Instruct16.4
49Meta logoLlama 4 Maverick15.6
50OpenAI logoGPT-4.1 Nano8.9
51Google DeepMind logoGemma 3 27B4.9
52Google DeepMind logoGemma 3 27B (free)4.9
53OpenAI logoGPT-4o-mini3.6
54OpenAI logoGPT-4o-mini (2024-07-18)3.6

Same category · related evaluations