Classement des modèles d’IA

Quel modèle d’IA est le plus performant ? Des classements fondés sur des tests indépendants menés par Epoch AI, avec les prix en regard pour trouver le meilleur modèle selon votre budget.

En bref

Catégorie
#ModèleIndice généraliGPQA DiamondiSWE-bench VerifiediEntréeiSortieiDate de sortie
1
166.6
95.8%—10 $US50 $USsept. 2026
2
165.0
——10 $US50 $USsept. 2026
3
163.6
85.9%—10 $US50 $USjuin 2026
4
Claude Opus 5Anthropic
162.7
93.9%—5 $US25 $USjuil. 2026
5
162.5
——30 $US180 $USavr. 2026
6
162.0
93.5%—2 $US10 $USjuil. 2026
7
159.3
93.3%—2 $US12 $USjuil. 2026
8
GPT-5.5OpenAI
159.3
90.7%—5 $US30 $USavr. 2026
9
159.1
94.6%—30 $US180 $USmars 2026
10
158.3
91.0%—5 $US25 $USmai 2026
11
Gemini 3.7 FlashGoogle DeepMind
157.7
94.8%—0,75 $US3,75 $USaoût 2026
12
Kimi K3Moonshot AI
157.7
93.1%—3 $US15 $USjuil. 2026
13
Gemini 3.8 FlashGoogle DeepMind
157.1
95.4%—0,75 $US3,75 $USsept. 2026
14
156.9
——1,25 $US4,25 $USsept. 2026
15
GPT-5.4OpenAI
156.9
93.3%76.9%2,50 $US15 $USmars 2026
16
156.8
—74.8%1,75 $US14 $USfévr. 2026
17
Qwen3.8 Max (0902)Alibaba Qwen
156.7
92.7%—2 $US6 $USsept. 2026
18
156.5
94.0%—2 $US6 $USaoût 2026
19
156.4
90.2%83.5%5 $US25 $USavr. 2026
20
156.3
91.6%—0,20 $US1,20 $USjuil. 2026
21
156.3
90.5%—2 $US10 $USjuin 2026
22
GLM 5.3Z.ai (Zhipu)
155.6
90.9%—1,40 $US4,40 $USaoût 2026
23
155.4
91.7%77.6%0,66 $US1,98 $USaoût 2026
24
155.4
90.5%78.7%5 $US25 $USfévr. 2026
25
155.4
——21 $US168 $USdéc. 2025
26
155.2
——1,25 $US4,25 $USaoût 2026
27
155.0
——0,30 $US1,20 $USsept. 2026
28
Gemini 3.1 Pro PreviewGoogle DeepMind
154.9
94.4%—2 $US12 $USfévr. 2026
29
Gemini 3.5 FlashGoogle DeepMind
154.6
92.8%79.3%1,50 $US9 $USmai 2026
30
154.5
91.0%—0,018 $US0,32 $USjuil. 2026
31
Gemini 3.6 FlashGoogle DeepMind
154.4
94.1%—0,75 $US3,75 $USjuil. 2026
32
154.3
——1,25 $US4,25 $USjuil. 2026
33
154.0
93.4%—2 $US6 $USjuil. 2026
34
Qwen3.7 MaxAlibaba Qwen
153.7
90.9%77.3%1,48 $US4,43 $USmai 2026
35
153.5
91.4%73.8%1,75 $US14 $USdéc. 2025
36
152.3
87.4%75.2%3 $US15 $USfévr. 2026
37
152.0
——1,25 $US2,50 $USmars 2026
38
GLM 5.3 FlashZ.ai (Zhipu)
151.9
90.2%—0,15 $US0,50 $USaoût 2026
39
GLM 5.2Z.ai (Zhipu)
151.8
91.9%78.7%0,14 $US3,99 $USjuin 2026
40
Gemini 3 Flash PreviewGoogle DeepMind
151.8
89.4%75.4%0,50 $US3 $USdéc. 2025
41
Kimi K2.6Moonshot AI
151.0
90.8%76.7%0,65 $US3,41 $USavr. 2026
42
GPT-5 ProOpenAI
150.3
——15 $US120 $USoct. 2025
43
Inkling SmallThinking Machines Lab
150.1
88.5%—0,45 $US1,20 $USjuil. 2026
44
150.1
86.0%76.7%5 $US25 $USnov. 2025
45
Kimi K2.7 CodeMoonshot AI
150.0
87.9%—0,66 $US3,30 $USjuin 2026
46
GPT-5OpenAI
150.0
86.2%73.6%1,25 $US10 $USaoût 2025
47
GLM 5.1Z.ai (Zhipu)
149.9
89.9%74.2%1,40 $US4,40 $USavr. 2026
48
GPT-5.1OpenAI
149.7
87.6%68.0%1,25 $US10 $USnov. 2025
49
Qwen3.8 27BAlibaba Qwen
149.4
——0,42 $US3 $USaoût 2026
50
149.3
87.4%76.7%1,03 $US6,16 $USavr. 2026
51
148.8
86.9%—0,75 $US4,50 $USmars 2026
52
InklingThinking Machines Lab
148.6
88.3%—1 $US4,05 $USjuil. 2026
53
Kimi K2.5Moonshot AI
148.1
—73.8%0,45 $US2,25 $USjanv. 2026
54
Qwen3.6 PlusAlibaba Qwen
147.7
88.4%57.9%0,33 $US1,95 $USavr. 2026
55
Qwen3.7 PlusAlibaba Qwen
147.4
87.9%—0,32 $US1,28 $USjuin 2026
56
o3 ProOpenAI
147.4
——20 $US80 $USjuin 2025
57
MiniMax M3MiniMax
147.0
90.9%—0,30 $US1,20 $USmai 2026
58
o3OpenAI
146.9
81.8%62.3%2 $US8 $USavr. 2025
59
146.8
84.8%—0,30 $US1,80 $USavr. 2026
60
146.8
82.3%71.3%3 $US15 $USsept. 2025
61
146.7
——0,27 $US1,08 $USfévr. 2026
62
Qwen3.5 397B A17BAlibaba Qwen
146.6
86.4%—0,55 $US3,50 $USfévr. 2026
63
Qwen3.6 27BAlibaba Qwen
146.5
85.9%—0,32 $US3,20 $USavr. 2026
64
146.3
——0,28 $US0,42 $USdéc. 2025
65
146.2
85.4%—0,60 $US2,40 $USjuin 2026
66
Kimi K2 ThinkingMoonshot AI
146.0
——0,60 $US2,50 $USnov. 2025
67
145.8
——0,21 $US0,84 $USmars 2026
68
145.8
78.5%—0,20 $US1,25 $USmars 2026
69
GLM 5Z.ai (Zhipu)
145.8
87.8%72.1%0,60 $US1,92 $USfévr. 2026
70
o4 MiniOpenAI
145.6
79.6%—1,10 $US4,40 $USavr. 2025
71
145.5
75.0%64.7%0,25 $US2 $USaoût 2025
72
Gemini 2.5 ProGoogle DeepMind
145.3
85.3%57.6%1,25 $US10 $USjuin 2025
73
Gemini 3.5 Flash LiteGoogle DeepMind
145.1
83.3%—0,30 $US2,50 $USjuil. 2026
74
145.0
——0,27 $US0,41 $USsept. 2025
75
Qwen3.7 FlashAlibaba Qwen
144.6
82.3%—0,03 $US0,13 $USjuil. 2026
76
Gemini 3.1 Flash LiteGoogle DeepMind
144.5
81.8%—0,25 $US1,50 $USmai 2026
77
144.1
77.3%73.3%15 $US75 $USaoût 2025
78
Qwen3.5-FlashAlibaba Qwen
144.0
82.3%—0,065 $US0,26 $USfévr. 2026
79
Qwen3.6 35B A3BAlibaba Qwen
143.9
84.8%—0,15 $US1 $USavr. 2026
80
143.9
80.1%—0,23 $US2,30 $USjuil. 2025
81
GLM 4.7Z.ai (Zhipu)
143.5
83.3%—0,60 $US2,20 $USdéc. 2025
82
Qwen3.6 FlashAlibaba Qwen
143.3
83.3%—0,19 $US1,13 $USavr. 2026
83
Gemini 2.5 FlashGoogle DeepMind
143.0
——0,30 $US2,50 $USjuin 2025
84
Gemma 4 31BGoogle DeepMind
142.7
75.8%—0,09 $US0,34 $USavr. 2026
85
Qwen3.5-35B-A3BAlibaba Qwen
142.5
83.5%—0,16 $US1,30 $USfévr. 2026
86
142.4
71.2%—1 $US5 $USoct. 2025
87
Qwen3 MaxAlibaba Qwen
142.4
72.6%—0,78 $US3,90 $USsept. 2025
88
Gemma 4 26B A4B Google DeepMind
141.9
73.2%—0,077 $US0,26 $USavr. 2026
89
o1OpenAI
141.9
76.8%—15 $US60 $USdéc. 2024
90
141.7
79.2%—3 $US15 $USmai 2025
91
141.4
——1,50 $US7,50 $USavr. 2026
92
R1 0528DeepSeek
141.3
76.3%—0,50 $US2,15 $USmai 2025
93
o3 MiniOpenAI
140.4
77.0%—1,10 $US4,40 $USjanv. 2025
94
Kimi K2 0905Moonshot AI
140.1
——0,60 $US2,50 $USsept. 2025
95
139.9
——0,25 $US0,95 $USaoût 2025
96
139.9
75.8%—0,037 $US0,17 $USaoût 2025
97
139.6
70.1%—0,20 $US2,40 $USaoût 2025
98
Qwen3.5-9BAlibaba Qwen
139.5
79.0%—0,10 $US0,15 $USmars 2026
99
139.4
69.4%—0,05 $US0,40 $USaoût 2025
100
139.4
70.7%—0,088 $US0,35 $USjuil. 2025
101
Qwen3 32BAlibaba Qwen
138.5
65.7%—0,08 $US0,28 $USavr. 2025
102
Qwen3 14BAlibaba Qwen
138.2
63.8%—0,12 $US0,24 $USavr. 2025
103
137.8
60.8%—0,018 $US0,09 $USaoût 2025
104
137.4
61.7%—0,048 $US0,19 $USjuil. 2025
105
GPT-4.1OpenAI
136.8
66.9%48.5%2 $US8 $USavr. 2025
106
Qwen3 8BAlibaba Qwen
136.2
56.8%—0,12 $US0,46 $USavr. 2025
107
DeepSeek V3DeepSeek
136.0
71.2%—0,26 $US1,03 $USdéc. 2024
108
135.0
65.8%—0,40 $US1,60 $USavr. 2025
109
134.1
——0,40 $US2 $USmai 2025
110
Gemini 2.5 Flash LiteGoogle DeepMind
133.9
——0,10 $US0,40 $USjuil. 2025
111
132.2
——0,19 $US0,65 $USavr. 2025
112
Phi 4Microsoft
130.4
56.1%—0,07 $US0,14 $USjanv. 2025
113
Gemma 3 27BGoogle DeepMind
130.0
47.7%—0,08 $US0,45 $USmars 2025
114
129.6
48.9%—0,10 $US0,40 $USavr. 2025
115
129.6
——0,10 $US0,30 $USavr. 2025
116
129.0
49.2%31.0%2,50 $US10 $USnov. 2024
117
129.0
49.1%—0,36 $US0,40 $USsept. 2024
118
127.3
47.4%—0,10 $US0,32 $USdéc. 2024
119
127.3
46.6%—10 $US30 $USavr. 2024
120
Mistral Small 3Mistral AI
127.1
47.3%—0,05 $US0,08 $USjanv. 2025
121
126.6
37.7%—0,15 $US0,60 $USjuil. 2024
122
125.9
44.2%—0,40 $US0,40 $USjuil. 2024
123
GPT-4OpenAI
125.9
35.7%—30 $US60 $USmai 2023
124
Gemma 3 12BGoogle DeepMind
123.5
39.5%—0,05 $US0,15 $USmars 2025
125
Gemma 2 27BGoogle DeepMind
122.1
36.5%—0,65 $US0,65 $USjuil. 2024
126
122.0
51.3%—0,50 $US1,50 $USdéc. 2025
127
122.0
——2 $US6 $USavr. 2024
128
119.4
——0,66 $US1 $USnov. 2024
129
119.3
——0,15 $US0,60 $USaoût 2024
130
Mistral NemoMistral AI
118.6
——0,019 $US0,03 $USjuil. 2024
131
118.5
28.0%—1 $US2 $USjanv. 2024
132
118.4
35.5%—0,10 $US0,20 $USoct. 2024
133
118.1
25.3%—0,10 $US0,10 $USdéc. 2025
134
116.5
27.0%—0,05 $US0,08 $USjuil. 2024
135
Gemma 3 4BGoogle DeepMind
116.0
23.2%—0,05 $US0,10 $USmars 2025
136
102.0
23.9%—0,027 $US0,20 $USsept. 2024

par million de tokens · USD

Comment lire ces classements

Les scores proviennent de tests menés de façon indépendante par Epoch AI, et non de chiffres publiés par les entreprises elles-mêmes. Quand un modèle a été testé avec plusieurs réglages (par exemple différents niveaux de raisonnement), nous affichons son meilleur résultat. Les modèles très récents apparaissent une fois testés, en général quelques semaines après leur sortie.

Indice général
Epoch Capabilities Index : un score unique qui combine des dizaines de benchmarks, pour comparer des modèles testés sur des épreuves différentes. Plus il est élevé, mieux c’est ; c’est un indice, pas un pourcentage.
SWE-bench Verified
Le modèle sait-il corriger de vrais bugs dans de vrais projets logiciels open source ? Part des tâches résolues.
GPQA Diamond
Questions à choix multiples très difficiles en biologie, physique et chimie, rédigées par des docteurs. Répondre au hasard donne 25 %.
Maths AIME
Problèmes de mathématiques de niveau concours, dans le style de l’AIME américain. Part des problèmes résolus.
FrontierMath
Problèmes de mathématiques inédits écrits par des mathématiciens professionnels, du niveau avancé au niveau recherche. Part résolue.
SimpleQA Verified
Questions factuelles courtes. Mesure à quelle fréquence le modèle donne le bon fait au lieu d’inventer.

Données de benchmarks : Epoch AI, sous licence CC BY 4.0 · Dernière mise à jour : 30 sept. 2026 · Notre méthode

CodeMathsSciencesPas cherGratuitsOpen sourceLong contexteImages et PDF

Meilleure IA pour votre langue →