Best AI Models for Coding

AI models ranked by coding benchmarks. Compare HumanEval+, SWE-bench Verified, Aider Polyglot, and more across all providers.

95
Models
11
Providers
33
Open Source
$0.97
Median $/1M in
#ModelAvgaider polyGSO-Benchswe bench swe bench terminal b$/1M inContext
1OpenAI logoGPT-5.5🇺🇸 OpenAI85.0----82.7$5.00400K
2OpenAI logoGPT-5 Chat🇺🇸 OpenAI81.988.0----$1.25128K
3Anthropic logoClaude Mythos Preview🇺🇸 Anthropic81.8--93.9-82.0N/A1.0M
4Google DeepMind logoGemini 2.5 Pro Preview 05-06🇺🇸 Google DeepMind76.976.9----$1.251.0M
5OpenAI logoo4 Mini High🇺🇸 OpenAI72.072.0----$1.10200K
6xAI logoGrok 3 Beta🇺🇸 xAI69.553.3----$3.00131K
7OpenAI logogpt-oss-120b (free)🇺🇸 OpenAIOpen68.741.8----Free131K
8xAI logoGrok 4.20🇺🇸 xAI66.1----57.3$1.252.0M
9xAI logoGrok 3 Mini Beta🇺🇸 xAI64.849.3----$0.30131K
10Google DeepMind logoGemini 3.5 Flash🇺🇸 Google DeepMind62.6--79.3--$1.501.0M
11OpenAI logoo3 Pro🇺🇸 OpenAI61.284.9----$20.00200K
12Google DeepMind logoGemini 3 Pro🇺🇸 Google DeepMind60.4-18.672.9-69.4N/A0K
13OpenAI logoo3 Mini High🇺🇸 OpenAI60.460.4----$1.10200K
14Alibaba Qwen logoQwen3.6 Plus🇨🇳 Alibaba QwenOpen59.9--57.9--$0.331.0M
15z-ai logoGLM 5.1🇨🇳 z-aiOpen59.8--74.2--$0.97203K
16DeepSeek logoDeepSeek V3🇨🇳 DeepSeekOpen59.048.4----$0.20131K
17OpenAI logoGPT-5.4🇺🇸 OpenAI58.9-31.476.9-81.8$2.501.1M
18Anthropic logoClaude Opus 4.7🇺🇸 Anthropic58.2-44.183.5-90.2$5.001.0M
19Alibaba Qwen logoQwen3 32B🇨🇳 Alibaba QwenOpen58.240.0----$0.08131K
20DeepSeek logoR1 0528🇨🇳 DeepSeekOpen57.971.4----$0.50164K
21Anthropic logoClaude Opus 4.6🇺🇸 Anthropic57.1-41.278.7-79.8$5.001.0M
22Google DeepMind logoGemini 3.1 Pro Preview🇺🇸 Google DeepMind56.6-22.675.6-80.2$2.001.0M
23Alibaba Qwen logoQwen3 235B A22B🇨🇳 Alibaba QwenOpen56.459.6----$0.46131K
24moonshotai logoKimi K2 0711🇨🇳 moonshotaiOpen56.259.14.9--27.8$0.57131K
25z-ai logoGLM 5🇨🇳 z-aiOpen56.1--72.1-52.4$0.60203K
26DeepSeek logoDeepSeek V3 0324🇨🇳 DeepSeekOpen55.155.1----$0.24164K
27minimax logoMiniMax M2.5🇨🇳 minimaxOpen55.1----42.7$0.15205K
28xAI logoGrok 4🇺🇸 xAI54.879.6---27.2N/A0K
29OpenAI logoGPT-5 Mini🇺🇸 OpenAI54.3--64.759.834.8$0.25400K
30OpenAI logoo3🇺🇸 OpenAI53.981.38.862.358.4-$2.00200K
31Google DeepMind logoGemini 2.0 Pro🇺🇸 Google DeepMind53.735.6----N/A0K
32OpenAI logoGPT-5.2🇺🇸 OpenAI53.6-27.473.871.864.9$1.75400K
33xAI logoGrok-3 mini🇺🇸 xAI53.349.3----N/A0K
34moonshotai logoKimi K2 Thinking🇨🇳 moonshotaiOpen53.3---63.435.7$0.60262K
35DeepSeek logoDeepSeek V3.2 Exp🇨🇳 DeepSeekOpen53.274.2----$0.27164K
36OpenAI logoGPT-5🇺🇸 OpenAI53.288.06.973.565.049.6$1.25400K
37Alibaba Qwen logoQwen2.5 Coder 32B Instruct🇨🇳 Alibaba QwenOpen53.116.4----$0.66128K
38Google DeepMind logoGemini 2.5 Pro🇺🇸 Google DeepMind52.783.13.957.6-32.6$1.251.0M
39OpenAI logoGPT-5.3-Codex🇺🇸 OpenAI52.4--74.8-78.4$1.75400K
40moonshotai logoKimi K2.5🇨🇳 moonshotaiOpen52.0--73.8-43.2$0.38262K
41moonshotai logoKimi K2.6🇨🇳 moonshotaiOpen51.7--76.7--$0.66262K
42DeepSeek logoDeepSeek V3.2🇨🇳 DeepSeekOpen51.274.2---39.6$0.21131K
43Alibaba Qwen logoQwen3.6 Max Preview🇨🇳 Alibaba QwenOpen51.2--76.7--$1.04262K
44Google DeepMind logoGemini 2.5 Pro Preview 06-05🇺🇸 Google DeepMind50.983.1----$1.251.0M
45OpenAI logoo4 Mini🇺🇸 OpenAI50.972.03.6-45.0-$1.10200K
46z-ai logoGLM 4.6🇨🇳 z-aiOpen50.8----24.5$0.43203K
47z-ai logoGLM 4.7🇨🇳 z-aiOpen50.5----33.4$0.40203K
48xAI logoGrok 4 Fast🇺🇸 xAI50.4-----N/A0K
49OpenAI logoGPT-5.1🇺🇸 OpenAI49.6-13.768.066.047.6$1.25400K
50OpenAI logoo1🇺🇸 OpenAI49.661.7----$15.00200K
51Alibaba Qwen logoQwen3 235B A22B Instruct 2507🇨🇳 Alibaba QwenOpen48.559.6----$0.09262K
52Anthropic logoClaude Sonnet 4.6🇺🇸 Anthropic48.0--75.2-53.4$3.001.0M
53Google DeepMind logoGemini 2.0 Flash🇺🇸 Google DeepMind48.038.2----$0.101.0M
54Google DeepMind logoGemini 2.0 Flash (Dec 2024)🇺🇸 Google DeepMind48.038.2----N/A0K
55Anthropic logoClaude 3.7 Sonnet🇺🇸 Anthropic47.764.93.861.052.8-N/A0K
56Google DeepMind logoGemini 3 Flash Preview🇺🇸 Google DeepMind47.7-9.875.4-64.3$0.501.0M
57OpenAI logogpt-oss-120b🇺🇸 OpenAIOpen46.941.8--26.018.7$0.04131K
58xAI logoGrok 3🇺🇸 xAI45.553.3----N/A0K
59DeepSeek logoR1🇨🇳 DeepSeekOpen45.156.9----$0.70164K
60OpenAI logoGPT-4.1 Mini🇺🇸 OpenAI44.532.4--23.9-$0.401.0M
61Anthropic logoClaude Opus 4.5🇺🇸 Anthropic43.6-26.576.774.463.1$5.00200K
62Anthropic logoClaude Sonnet 4🇺🇸 Anthropic43.361.34.9-64.9-$3.001.0M
63OpenAI logoGPT-4.1🇺🇸 OpenAI43.352.4-48.539.6-$2.001.0M
64OpenAI logoGPT-5 Nano🇺🇸 OpenAI43.3---34.821.8$0.05400K
65OpenAI logoGPT-4o-mini (2024-07-18)🇺🇸 OpenAI43.23.6----$0.15128K
66Anthropic logoClaude 3.5 Sonnet🇺🇸 Anthropic42.351.64.6---N/A0K
67Google DeepMind logoGemma 3 27B🇺🇸 Google DeepMindOpen42.24.9----$0.08131K
68Google DeepMind logoGemma 3 27B (free)🇺🇸 Google DeepMindOpen42.24.9----Free131K
69Anthropic logoClaude Opus 4🇺🇸 Anthropic41.772.06.970.767.6-$15.00200K
70Google DeepMind logoGemini 1.5 Pro (May 2024)🇺🇸 Google DeepMind41.5-----N/A0K
71OpenAI logoo1-preview🇺🇸 OpenAI41.5-----N/A0K
72Google DeepMind logoGemini 1.5 Pro (Feb 2024)🇺🇸 Google DeepMind41.3-----N/A0K
73Alibaba Qwen logoQwen2.5-Max🇨🇳 Alibaba QwenOpen41.021.8----N/A0K
74Anthropic logoClaude Sonnet 4.5🇺🇸 Anthropic39.6-14.771.370.646.5$3.001.0M
75OpenAI logoGPT-4o-mini🇺🇸 OpenAI39.63.6----$0.15128K
76Google DeepMind logoGemini 2.5 Flash🇺🇸 Google DeepMind38.547.1---17.1$0.301.0M
77Meta logoLlama 3.1 405B🇺🇸 MetaOpen38.0-----N/A0K
78Google DeepMind logoGemini 2.0 Flash Thinking (Jan 2025)🇺🇸 Google DeepMind37.718.2----N/A0K
79Anthropic logoClaude 3.5 Haiku🇺🇸 Anthropic37.228.0----N/A0K
80Anthropic logoClaude Opus 4.1🇺🇸 Anthropic37.0--73.3-38.0$15.00200K
81OpenAI logoGPT-4o (2024-11-20)🇺🇸 OpenAI36.423.10.031.021.6-$2.50128K
82OpenAI logoGPT-4.5🇺🇸 OpenAI35.944.9----N/A0K
83OpenAI logoGPT-4o (2024-08-06)🇺🇸 OpenAI35.623.1----$2.50128K
84OpenAI logoGPT-4.1 Nano🇺🇸 OpenAI35.28.9----$0.101.0M
85OpenAI logoo3 Mini🇺🇸 OpenAI35.260.41.3---$1.10200K
86OpenAI logoo1-mini🇺🇸 OpenAI34.932.9----N/A0K
87Anthropic logoClaude Haiku 4.5🇺🇸 Anthropic34.3----35.5$1.00200K
88Anthropic logoClaude 3 Opus🇺🇸 Anthropic33.7-----N/A0K
89Meta logoLlama 3 70B Instruct🇺🇸 MetaOpen32.4-----$0.518K
90Anthropic logoClaude 3 Haiku🇺🇸 Anthropic28.7-----$0.25200K
91Meta logoLlama 4 Maverick🇺🇸 MetaOpen28.015.6--21.0-$0.151.0M
92Meta logoLlama 3-70B🇺🇸 MetaOpen24.7-----N/A0K
93Mistral AI logoMixtral 8x22B Instruct🇫🇷 Mistral AIOpen23.5-----$2.0066K
94Meta logoLlama 4 Scout🇺🇸 MetaOpen18.9---9.1-$0.1010.0M
95Alibaba Qwen logoQwQ 32B🇨🇳 Alibaba QwenOpen13.520.9----$0.15131K
90+ Gold 80-89 70-79 60-69 <60Scores in % unless noted. Avg = unweighted mean across tested benchmarks.

Models ranked by coding performance across HumanEval+, SWE-bench Verified, Aider Polyglot, and other code generation benchmarks. Scores reflect real-world software engineering tasks including bug fixing, code completion, and multi-file editing.

Which AI model is best for coding?

The top-ranked coding model changes frequently. Check the live leaderboard above for the current leader based on HumanEval+, SWE-bench Verified, and other coding benchmarks.

What benchmarks measure coding ability?

Key coding benchmarks include HumanEval+ (function completion), SWE-bench Verified (real GitHub issues), Aider Polyglot (multi-language editing), and Terminal-bench (CLI tasks).

Are open-source models competitive for coding?

Yes. Several open-source models score competitively on coding benchmarks, especially models from DeepSeek and Meta.