Kategoria „Kodowanie” klasyfikuje modele sztucznej inteligencji pod kątem ich możliwości w zakresie inżynierii oprogramowania. Zestawienie ocenia zdolność modeli do generowania poprawnego i wysokiej jakości kodu w wielu językach programowania, implementowania zaawansowanych struktur danych, refaktoryzacji kodu oraz rozwiązywania problemów algorytmicznych.

Ranking opiera się na uznanych benchmarkach i wskaźnikach branżowych związanych z kodowaniem. Pozwala to wskazać modele, które najlepiej sprawdzają się jako wsparcie w codziennej pracy programistów i zespołów deweloperskich.

Szukasz modelu o szerszym spektrum możliwości? Kodowanie odpowiada za 30% ogólnej punktacji. Zobacz ogólny ranking modeli AI, aby sprawdzić, jak najlepsze LLMy radzą sobie również z zadaniami agentowymi, matematyką i wieloetapowym wnioskowaniem.

Ostatnia aktualizacja: 2 października 2026
Poz. Nazwa Modelu Względna jakość Wynik
1 Claude Opus 5.5
Jakość kodowania 99,51%

99,51
2 Claude Sonnet 5.5
Jakość kodowania 95,91%

95,91
3 GPT-6 Astra
Jakość kodowania 92,87%

92,87
4 GPT-5.6 Sol
Jakość kodowania 91,33%

91,33
5 ERNIE 5.0
Jakość kodowania 89,66%

89,66
6 Gemini 4 Argon
Jakość kodowania 89,42%

89,42
7 Claude Fable 5.1
Jakość kodowania 88,84%

88,84
8 Claude Fable 5
Jakość kodowania 88,50%

88,50
9 GPT-6.1 Sol
Jakość kodowania 88,00%

88,00
10 Kimi K3
Jakość kodowania 86,89%

86,89
11 Muse Spark 1.3
Jakość kodowania 86,77%

86,77
12 Claude Opus 5
Jakość kodowania 86,76%

86,76
13 ChatGPT-4o
Jakość kodowania 86,26%

86,26
14 GPT-5.6 Terra
Jakość kodowania 86,20%

86,20
15 GPT-5.5
Jakość kodowania 85,74%

85,74
16 Qwen3 VL 235B A22B
Jakość kodowania 85,67%

85,67
17 GPT-6 Sol
Jakość kodowania 84,89%

84,89
18 GPT-5.5 Instant
Jakość kodowania 84,86%

84,86
19 GLM-5.3
Jakość kodowania 84,54%

84,54
20 Mistral
Jakość kodowania 84,34%

84,34
21 MiMo-V2.6-Pro
Jakość kodowania 84,31%

84,31
22 GPT-5.6 Luna
Jakość kodowania 84,17%

84,17
23 DeepSeek-V4.1-Flash
Jakość kodowania 83,64%

83,64
24 Grok 4.7
Jakość kodowania 82,75%

82,75
25 Qwen3.8
Jakość kodowania 82,26%

82,26
26 Claude Opus 4.8
Jakość kodowania 81,42%

81,42
27 Claude Opus 4.7
Jakość kodowania 80,73%

80,73
28 Gemini 3.7 Flash
Jakość kodowania 80,66%

80,66
29 Grok 4.6
Jakość kodowania 80,57%

80,57
30 MiMo-V2.6-Flash
Jakość kodowania 80,47%

80,47
31 Gemini 3.8 Flash
Jakość kodowania 79,88%

79,88
32 DeepSeek-V4-Pro
Jakość kodowania 79,59%

79,59
33 GLM-5.3-Flash
Jakość kodowania 79,45%

79,45
34 Step 5
Jakość kodowania 79,32%

79,32
35 GLM-5.2
Jakość kodowania 79,27%

79,27
36 Muse Spark 1.1
Jakość kodowania 78,78%

78,78
37 INTELLECT-3
Jakość kodowania 78,73%

78,73
38 GLM-4.6V
Jakość kodowania 78,73%

78,73
39 Claude Sonnet 5
Jakość kodowania 78,66%

78,66
40 Mistral Small
Jakość kodowania 78,14%

78,14
41 GPT-6 Luna
Jakość kodowania 77,94%

77,94
42 Hy4
Jakość kodowania 77,90%

77,90
43 Ling-flash-2.0
Jakość kodowania 77,84%

77,84
44 Claude Opus 4.6
Jakość kodowania 77,57%

77,57
45 GLM-4.5V
Jakość kodowania 76,81%

76,81
46 Qwen2.5
Jakość kodowania 76,66%

76,66
47 Qwen3.8-Flash-Next
Jakość kodowania 76,49%

76,49
48 DeepSeek-V4-Flash
Jakość kodowania 76,35%

76,35
49 Muse Spark 1.2
Jakość kodowania 76,03%

76,03
50 Grok 4.5
Jakość kodowania 75,77%

75,77
51 Kimi K2.6
Jakość kodowania 75,66%

75,66
52 Qwen3.7
Jakość kodowania 75,43%

75,43
53 Qwen3.8-27B
Jakość kodowania 75,20%

75,20
54 Ring-flash-2.0
Jakość kodowania 74,89%

74,89
55 Gemini 3.6 Flash
Jakość kodowania 74,61%

74,61
56 Gemini 3.5 Flash
Jakość kodowania 74,47%

74,47
57 GPT-5 nano
Jakość kodowania 74,00%

74,00
58 Gemini 3.1 Pro
Jakość kodowania 73,96%

73,96
59 Qwen3.7-Plus
Jakość kodowania 73,59%

73,59
60 Olmo 3.1 32B
Jakość kodowania 73,56%

73,56
61 Claude Opus 4.5
Jakość kodowania 73,47%

73,47
62 Grok Build 0.1
Jakość kodowania 73,24%

73,24
63 Claude Sonnet 4.6
Jakość kodowania 73,05%

73,05
64 Muse Spark
Jakość kodowania 71,31%

71,31
65 MiMo-V2.5-Pro
Jakość kodowania 70,78%

70,78
66 Hy3
Jakość kodowania 70,77%

70,77
67 Qwen3.6 Plus
Jakość kodowania 70,74%

70,74
68 Olmo 3 32B Think
Jakość kodowania 70,46%

70,46
69 MiniMax M3
Jakość kodowania 69,96%

69,96
70 GPT-5.4
Jakość kodowania 69,83%

69,83
71 Seed 2.0 Pro
Jakość kodowania 69,57%

69,57
72 Mistral Large
Jakość kodowania 69,57%

69,57
73 Qwen3.6
Jakość kodowania 69,18%

69,18
74 GLM-5.1
Jakość kodowania 68,69%

68,69
75 DeepSeek V3.1 Terminus
Jakość kodowania 68,45%

68,45
76 Olmo 3.1 32B Think
Jakość kodowania 67,65%

67,65
77 Kimi K2.7 Code
Jakość kodowania 67,26%

67,26
78 Qwen3.6-27B
Jakość kodowania 67,16%

67,16
79 GPT-5 mini
Jakość kodowania 67,14%

67,14
80 GPT-5.2
Jakość kodowania 67,07%

67,07
81 GPT-5.3 Codex
Jakość kodowania 67,07%

67,07
82 GPT-5.4 nano
Jakość kodowania 66,75%

66,75
83 MiMo-V2-Omni
Jakość kodowania 66,57%

66,57
84 Inkling
Jakość kodowania 66,50%

66,50
85 Kimi K2
Jakość kodowania 65,92%

65,92
86 LongCat-Flash
Jakość kodowania 65,81%

65,81
87 Seed 2.1 Pro
Jakość kodowania 65,73%

65,73
88 Llama 3.1 Nemotron 70B
Jakość kodowania 65,73%

65,73
89 GPT-5.4 mini
Jakość kodowania 65,44%

65,44
90 Grok 4.3
Jakość kodowania 65,09%

65,09
91 Step-3.5-Flash
Jakość kodowania 64,45%

64,45
92 Inkling-Small
Jakość kodowania 64,43%

64,43
93 MiMo-V2.5
Jakość kodowania 64,38%

64,38
94 Claude Opus 4
Jakość kodowania 64,32%

64,32
95 Granite 4.2 30B
Jakość kodowania 64,02%

64,02
96 MiniMax M2.7
Jakość kodowania 63,51%

63,51
97 Jamba 1.5 Large
Jakość kodowania 63,37%

63,37
98 Gemini 3 Pro
Jakość kodowania 63,24%

63,24
99 GLM-5
Jakość kodowania 63,23%

63,23
100 MiMo-V2-Pro
Jakość kodowania 63,18%

63,18