Kategoria „Kodowanie” klasyfikuje modele sztucznej inteligencji pod kątem ich możliwości w zakresie inżynierii oprogramowania. Zestawienie ocenia zdolność modeli do generowania poprawnego i wysokiej jakości kodu w wielu językach programowania, implementowania zaawansowanych struktur danych, refaktoryzacji kodu oraz rozwiązywania problemów algorytmicznych.
Ranking opiera się na uznanych benchmarkach i wskaźnikach branżowych związanych z kodowaniem. Pozwala to wskazać modele, które najlepiej sprawdzają się jako wsparcie w codziennej pracy programistów i zespołów deweloperskich.
Szukasz modelu o szerszym spektrum możliwości? Kodowanie odpowiada za 30% ogólnej punktacji. Zobacz ogólny ranking modeli AI, aby sprawdzić, jak najlepsze LLMy radzą sobie również z zadaniami agentowymi, matematyką i wieloetapowym wnioskowaniem.
| Poz. | Nazwa Modelu | Względna jakość | Wynik |
|---|---|---|---|
| 1 | Claude Opus 5.5 |
|
99,51 |
| 2 | Claude Sonnet 5.5 |
|
95,91 |
| 3 | GPT-6 Astra |
|
92,87 |
| 4 | GPT-5.6 Sol |
|
91,33 |
| 5 | ERNIE 5.0 |
|
89,66 |
| 6 | Gemini 4 Argon |
|
89,42 |
| 7 | Claude Fable 5.1 |
|
88,84 |
| 8 | Claude Fable 5 |
|
88,50 |
| 9 | GPT-6.1 Sol |
|
88,00 |
| 10 | Kimi K3 |
|
86,89 |
| 11 | Muse Spark 1.3 |
|
86,77 |
| 12 | Claude Opus 5 |
|
86,76 |
| 13 | ChatGPT-4o |
|
86,26 |
| 14 | GPT-5.6 Terra |
|
86,20 |
| 15 | GPT-5.5 |
|
85,74 |
| 16 | Qwen3 VL 235B A22B |
|
85,67 |
| 17 | GPT-6 Sol |
|
84,89 |
| 18 | GPT-5.5 Instant |
|
84,86 |
| 19 | GLM-5.3 |
|
84,54 |
| 20 | Mistral |
|
84,34 |
| 21 | MiMo-V2.6-Pro |
|
84,31 |
| 22 | GPT-5.6 Luna |
|
84,17 |
| 23 | DeepSeek-V4.1-Flash |
|
83,64 |
| 24 | Grok 4.7 |
|
82,75 |
| 25 | Qwen3.8 |
|
82,26 |
| 26 | Claude Opus 4.8 |
|
81,42 |
| 27 | Claude Opus 4.7 |
|
80,73 |
| 28 | Gemini 3.7 Flash |
|
80,66 |
| 29 | Grok 4.6 |
|
80,57 |
| 30 | MiMo-V2.6-Flash |
|
80,47 |
| 31 | Gemini 3.8 Flash |
|
79,88 |
| 32 | DeepSeek-V4-Pro |
|
79,59 |
| 33 | GLM-5.3-Flash |
|
79,45 |
| 34 | Step 5 |
|
79,32 |
| 35 | GLM-5.2 |
|
79,27 |
| 36 | Muse Spark 1.1 |
|
78,78 |
| 37 | INTELLECT-3 |
|
78,73 |
| 38 | GLM-4.6V |
|
78,73 |
| 39 | Claude Sonnet 5 |
|
78,66 |
| 40 | Mistral Small |
|
78,14 |
| 41 | GPT-6 Luna |
|
77,94 |
| 42 | Hy4 |
|
77,90 |
| 43 | Ling-flash-2.0 |
|
77,84 |
| 44 | Claude Opus 4.6 |
|
77,57 |
| 45 | GLM-4.5V |
|
76,81 |
| 46 | Qwen2.5 |
|
76,66 |
| 47 | Qwen3.8-Flash-Next |
|
76,49 |
| 48 | DeepSeek-V4-Flash |
|
76,35 |
| 49 | Muse Spark 1.2 |
|
76,03 |
| 50 | Grok 4.5 |
|
75,77 |
| 51 | Kimi K2.6 |
|
75,66 |
| 52 | Qwen3.7 |
|
75,43 |
| 53 | Qwen3.8-27B |
|
75,20 |
| 54 | Ring-flash-2.0 |
|
74,89 |
| 55 | Gemini 3.6 Flash |
|
74,61 |
| 56 | Gemini 3.5 Flash |
|
74,47 |
| 57 | GPT-5 nano |
|
74,00 |
| 58 | Gemini 3.1 Pro |
|
73,96 |
| 59 | Qwen3.7-Plus |
|
73,59 |
| 60 | Olmo 3.1 32B |
|
73,56 |
| 61 | Claude Opus 4.5 |
|
73,47 |
| 62 | Grok Build 0.1 |
|
73,24 |
| 63 | Claude Sonnet 4.6 |
|
73,05 |
| 64 | Muse Spark |
|
71,31 |
| 65 | MiMo-V2.5-Pro |
|
70,78 |
| 66 | Hy3 |
|
70,77 |
| 67 | Qwen3.6 Plus |
|
70,74 |
| 68 | Olmo 3 32B Think |
|
70,46 |
| 69 | MiniMax M3 |
|
69,96 |
| 70 | GPT-5.4 |
|
69,83 |
| 71 | Seed 2.0 Pro |
|
69,57 |
| 72 | Mistral Large |
|
69,57 |
| 73 | Qwen3.6 |
|
69,18 |
| 74 | GLM-5.1 |
|
68,69 |
| 75 | DeepSeek V3.1 Terminus |
|
68,45 |
| 76 | Olmo 3.1 32B Think |
|
67,65 |
| 77 | Kimi K2.7 Code |
|
67,26 |
| 78 | Qwen3.6-27B |
|
67,16 |
| 79 | GPT-5 mini |
|
67,14 |
| 80 | GPT-5.2 |
|
67,07 |
| 81 | GPT-5.3 Codex |
|
67,07 |
| 82 | GPT-5.4 nano |
|
66,75 |
| 83 | MiMo-V2-Omni |
|
66,57 |
| 84 | Inkling |
|
66,50 |
| 85 | Kimi K2 |
|
65,92 |
| 86 | LongCat-Flash |
|
65,81 |
| 87 | Seed 2.1 Pro |
|
65,73 |
| 88 | Llama 3.1 Nemotron 70B |
|
65,73 |
| 89 | GPT-5.4 mini |
|
65,44 |
| 90 | Grok 4.3 |
|
65,09 |
| 91 | Step-3.5-Flash |
|
64,45 |
| 92 | Inkling-Small |
|
64,43 |
| 93 | MiMo-V2.5 |
|
64,38 |
| 94 | Claude Opus 4 |
|
64,32 |
| 95 | Granite 4.2 30B |
|
64,02 |
| 96 | MiniMax M2.7 |
|
63,51 |
| 97 | Jamba 1.5 Large |
|
63,37 |
| 98 | Gemini 3 Pro |
|
63,24 |
| 99 | GLM-5 |
|
63,23 |
| 100 | MiMo-V2-Pro |
|
63,18 |