Best AI Models for Coding

AI models ranked by coding benchmarks. Compare HumanEval+, SWE-bench Verified, Aider Polyglot, and more across all providers.

104
Models
11
Providers
40
Open Source
$0.95
Median $/1M in
#ModelAvgaider polyGSO-Benchswe bench swe bench terminal b$/1M inContext
1OpenAI logoGPT-5.5🇺🇸 OpenAI85.0----82.7$5.00400K
2OpenAI logoGPT-5 Chat🇺🇸 OpenAI81.988.0----$1.25128K
3Anthropic logoClaude Mythos Preview🇺🇸 Anthropic81.8--93.9-82.0N/A1.0M
4Google DeepMind logoGemini 2.5 Pro Preview 05-06🇺🇸 Google DeepMind76.976.9----$1.251.0M
5OpenAI logoo4 Mini High🇺🇸 OpenAI72.072.0----$1.10200K
6xAI logoGrok 3 Beta🇺🇸 xAI69.553.3----$3.00131K
7OpenAI logogpt-oss-120b (free)🇺🇸 OpenAIOpen68.741.8----Free131K
8xAI logoGrok 3 Mini Beta🇺🇸 xAI64.849.3----$0.30131K
9OpenAI logoo3 Pro🇺🇸 OpenAI61.384.9----$20.00200K
10Alibaba Qwen logoQwen3.7 Max🇨🇳 Alibaba QwenOpen61.3--77.3--$1.251.0M
11OpenAI logoo3 Mini High🇺🇸 OpenAI60.460.4----$1.10200K
12DeepSeek logoR1 0528🇨🇳 DeepSeekOpen57.971.4----$0.50164K
13Anthropic logoClaude Sonnet 5🇺🇸 Anthropic56.7-37.3---$2.001.0M
14z-ai logoGLM 5.2🇨🇳 z-aiOpen56.4--78.7--$1.001.0M
15Google DeepMind logoGemini 3 Pro🇺🇸 Google DeepMind56.1-18.672.9-69.4N/A0K
16DeepSeek logoDeepSeek V3🇨🇳 DeepSeekOpen56.148.4----$0.26164K
17moonshotai logoKimi K2 0711🇨🇳 moonshotaiOpen56.159.14.9--27.8$0.57131K
18Anthropic logoClaude Opus 4.8🇺🇸 Anthropic55.4-47.1---$5.001.0M
19OpenAI logoGPT-5.3-Codex🇺🇸 OpenAI55.4--74.8-77.3$1.75400K
20DeepSeek logoDeepSeek V3 0324🇨🇳 DeepSeekOpen55.155.1----$0.25164K
21Google DeepMind logoGemini 3.5 Flash🇺🇸 Google DeepMind54.8--79.3--$1.501.0M
22z-ai logoGLM 5🇨🇳 z-aiOpen54.7--72.1-52.4$0.60205K
23z-ai logoGLM 5.1🇨🇳 z-aiOpen54.3--74.2--$0.97205K
24DeepSeek logoDeepSeek V4 Pro🇨🇳 DeepSeekOpen53.9--77.6--$0.211.0M
25xAI logoGrok 4🇺🇸 xAI53.979.6---27.2N/A0K
26Alibaba Qwen logoQwen3 235B A22B🇨🇳 Alibaba QwenOpen53.759.6----$0.46131K
27Google DeepMind logoGemini 2.0 Pro🇺🇸 Google DeepMind53.735.6----N/A0K
28xAI logoGrok-3 mini🇺🇸 xAI53.649.3----N/A0K
29Alibaba Qwen logoQwen3.6 Plus🇨🇳 Alibaba QwenOpen53.5--57.9--$0.331.0M
30xAI logoGrok 4 Fast🇺🇸 xAI53.3-----N/A0K
31Alibaba Qwen logoQwen2.5 Coder 32B Instruct🇨🇳 Alibaba QwenOpen53.116.4----$0.6633K
32OpenAI logogpt-oss-20b🇺🇸 OpenAIOpen53.1----3.4$0.02131K
33OpenAI logoGPT-5🇺🇸 OpenAI53.188.06.973.565.049.6$1.25400K
34moonshotai logoKimi K2 Thinking🇨🇳 moonshotaiOpen52.2---63.435.7$0.60262K
35OpenAI logoGPT-5.4🇺🇸 OpenAI51.7-31.476.9-81.8$2.501.1M
36Alibaba Qwen logoQwen3 32B🇨🇳 Alibaba QwenOpen51.540.0----$0.08131K
37OpenAI logoGPT-5 Mini🇺🇸 OpenAI51.5--64.759.834.8$0.25400K
38OpenAI logoo3🇺🇸 OpenAI51.281.38.862.358.4-$2.00200K
39Alibaba Qwen logoQwen3.6 Max Preview🇨🇳 Alibaba QwenOpen51.0--76.7--$1.03262K
40Google DeepMind logoGemini 2.5 Pro Preview 06-05🇺🇸 Google DeepMind50.983.1----$1.251.0M
41Google DeepMind logoGemini 2.5 Pro🇺🇸 Google DeepMind50.883.13.957.6-32.6$1.251.0M
42z-ai logoGLM 4.6🇨🇳 z-aiOpen50.8----24.5$0.43205K
43Anthropic logoClaude Opus 4.7🇺🇸 Anthropic50.5-44.183.5-80.2$5.001.0M
44minimax logoMiniMax M2.7🇨🇳 minimaxOpen50.5----45.1$0.21205K
45Google DeepMind logoGemini 3 Flash Preview🇺🇸 Google DeepMind49.6-9.875.4-64.3$0.501.0M
46moonshotai logoKimi K2.5🇨🇳 moonshotaiOpen49.4--73.8-43.2$0.45262K
47OpenAI logogpt-oss-120b🇺🇸 OpenAIOpen49.341.8--26.018.7$0.04131K
48xAI logoGrok 4.20🇺🇸 xAI48.8----57.3$1.252.0M
49minimax logoMiniMax M2.5🇨🇳 minimaxOpen48.6----42.7$0.27205K
50OpenAI logoo4 Mini🇺🇸 OpenAI48.672.03.6-45.0-$1.10200K
51DeepSeek logoDeepSeek V3.2 Exp🇨🇳 DeepSeekOpen48.474.2----$0.27164K
52Alibaba Qwen logoQwen3 235B A22B Instruct 2507🇨🇳 Alibaba QwenOpen48.359.6----$0.09262K
53Google DeepMind logoGemini 3.1 Pro Preview🇺🇸 Google DeepMind48.2-22.675.6-80.2$2.001.0M
54Anthropic logoClaude 3.7 Sonnet🇺🇸 Anthropic48.164.93.861.052.8-N/A0K
55Anthropic logoClaude Opus 4.6🇺🇸 Anthropic48.1-33.378.7-79.8$5.001.0M
56Google DeepMind logoGemini 2.0 Flash🇺🇸 Google DeepMind48.038.2----$0.101.0M
57DeepSeek logoDeepSeek V3.2🇨🇳 DeepSeekOpen47.774.2---39.5$0.28164K
58Google DeepMind logoGemini 2.0 Flash (Dec 2024)🇺🇸 Google DeepMind47.638.2----N/A0K
59OpenAI logoGPT-5.2🇺🇸 OpenAI47.0-27.473.871.864.9$1.75400K
60OpenAI logoGPT-5.1🇺🇸 OpenAI47.0-13.768.066.047.6$1.25400K
61Anthropic logoClaude Opus 4🇺🇸 Anthropic46.172.06.970.767.6-$15.00200K
62z-ai logoGLM 4.7🇨🇳 z-aiOpen46.0----33.4$0.60205K
63DeepSeek logoR1🇨🇳 DeepSeekOpen45.656.9----$0.7064K
64Anthropic logoClaude Sonnet 4🇺🇸 Anthropic45.561.34.9-64.9-$3.00200K
65xAI logoGrok 3🇺🇸 xAI45.553.3----N/A0K
66OpenAI logoo1🇺🇸 OpenAI45.361.7----$15.00200K
67Anthropic logoClaude Sonnet 4.6🇺🇸 Anthropic45.3--75.2-53.4$3.001.0M
68OpenAI logoGPT-4o-mini (2024-07-18)🇺🇸 OpenAI43.23.6----$0.15128K
69Google DeepMind logoGemma 3 27B (free)🇺🇸 Google DeepMindOpen42.24.9----Free131K
70OpenAI logoo1-preview🇺🇸 OpenAI41.9-----N/A0K
71Anthropic logoClaude Opus 4.5🇺🇸 Anthropic41.6-26.576.774.463.1$5.00200K
72Alibaba Qwen logoQwen3.6 35B A3B🇨🇳 Alibaba QwenOpen41.6----23.0$0.15262K
73Google DeepMind logoGemini 1.5 Pro (Feb 2024)🇺🇸 Google DeepMind41.3-----N/A0K
74Alibaba Qwen logoQwen2.5-Max🇨🇳 Alibaba QwenOpen41.121.8----N/A0K
75OpenAI logoGPT-4.1🇺🇸 OpenAI39.552.4-48.539.6-$2.001.0M
76Anthropic logoClaude 3.5 Sonnet🇺🇸 Anthropic39.451.64.6---N/A0K
77Google DeepMind logoGemini 2.5 Flash🇺🇸 Google DeepMind39.347.1---17.1$0.301.0M
78OpenAI logoGPT-5 Nano🇺🇸 OpenAI39.2---34.821.8$0.05400K
79Alibaba Qwen logoQwen3.5-9B🇨🇳 Alibaba QwenOpen38.5----9.2$0.10262K
80Google DeepMind logoGemini 1.5 Pro (May 2024)🇺🇸 Google DeepMind38.4-----N/A0K
81moonshotai logoKimi K2.6🇨🇳 moonshotaiOpen38.3--76.7--$0.95262K
82Meta logoLlama 3.1 405B🇺🇸 MetaOpen37.9-----N/A0K
83Anthropic logoClaude Sonnet 4.5🇺🇸 Anthropic37.8-14.771.370.646.5$3.001.0M
84Google DeepMind logoGemini 2.0 Flash Thinking (Jan 2025)🇺🇸 Google DeepMind37.718.2----N/A0K
85Anthropic logoClaude 3.5 Haiku🇺🇸 Anthropic36.728.0----N/A0K
86OpenAI logoGPT-4.1 Mini🇺🇸 OpenAI36.632.4--23.9-$0.401.0M
87Google DeepMind logoGemma 3 27B🇺🇸 Google DeepMindOpen36.64.9----$0.08131K
88Anthropic logoClaude Opus 4.1🇺🇸 Anthropic36.3--73.3-38.0$15.00200K
89OpenAI logoGPT-4.5🇺🇸 OpenAI35.944.9----N/A0K
90OpenAI logoGPT-4o (2024-08-06)🇺🇸 OpenAI35.623.1----$2.50128K
91OpenAI logoo1-mini🇺🇸 OpenAI35.032.9----N/A0K
92Anthropic logoClaude Haiku 4.5🇺🇸 Anthropic33.6----35.5$1.00200K
93OpenAI logoo3 Mini🇺🇸 OpenAI32.560.41.3---$1.10200K
94Meta logoLlama 3 70B Instruct🇺🇸 MetaOpen32.4-----$0.518K
95OpenAI logoGPT-4o (2024-11-20)🇺🇸 OpenAI32.323.10.031.021.6-$2.50128K
96Meta logoLlama 3-70B🇺🇸 MetaOpen32.1-----N/A0K
97Alibaba Qwen logoQwQ 32B🇨🇳 Alibaba QwenOpen30.920.9----$0.15131K
98OpenAI logoGPT-4.1 Nano🇺🇸 OpenAI30.98.9----$0.101.0M
99OpenAI logoGPT-4o-mini🇺🇸 OpenAI29.23.6----$0.15128K
100Anthropic logoClaude 3 Opus🇺🇸 Anthropic28.0-----N/A0K
101Meta logoLlama 4 Maverick🇺🇸 MetaOpen27.915.6--21.0-$0.191.0M
102Anthropic logoClaude 3 Haiku🇺🇸 Anthropic25.7-----$0.25200K
103Mistral AI logoMixtral 8x22B Instruct🇫🇷 Mistral AIOpen23.8-----$2.0066K
104Meta logoLlama 4 Scout🇺🇸 MetaOpen19.5---9.1-$0.101.3M
90+ Gold 80-89 70-79 60-69 <60Scores in % unless noted. Avg = unweighted mean across tested benchmarks.

Models ranked by coding performance across HumanEval+, SWE-bench Verified, Aider Polyglot, and other code generation benchmarks. Scores reflect real-world software engineering tasks including bug fixing, code completion, and multi-file editing.

Which AI model is best for coding?

The top-ranked coding model changes frequently. Check the live leaderboard above for the current leader based on HumanEval+, SWE-bench Verified, and other coding benchmarks.

What benchmarks measure coding ability?

Key coding benchmarks include HumanEval+ (function completion), SWE-bench Verified (real GitHub issues), Aider Polyglot (multi-language editing), and Terminal-bench (CLI tasks).

Are open-source models competitive for coding?

Yes. Several open-source models score competitively on coding benchmarks, especially models from DeepSeek and Meta.