Pas besoin d’un centre de données pour faire tourner un modèle d’IA capable. Les modèles à poids ouverts tournent sur un PC de jeu ou un Mac récent, gratuitement et sans rien envoyer en ligne. La vraie question est de savoir lesquels tiennent. Nous avons pris les 61 modèles ouverts qui ont un score indépendant, calculé la mémoire dont chacun a besoin une fois compressé en 4 bits (la façon habituelle de les utiliser chez soi), et comparé le tout aux quantités de mémoire courantes.
Ce qui tient sur chaque carte graphique
| Mémoire | Modèles qui tiennent | Le meilleur (indice général) |
|---|---|---|
| Carte graphique de 8 Go | 7 | Qwen3.5-9B (139,5) |
| Carte graphique de 12 Go | 11 | Qwen3.5-9B (139,5) |
| Carte graphique de 16 Go | 12 | Qwen3.5-9B (139,5) |
| Carte graphique de 24 Go | 23 | Qwen3.8 27B (149,4) |
| Carte graphique de 32 Go | 25 | Qwen3.8 27B (149,4) |
| Mac avec 32 Go | 23 | Qwen3.8 27B (149,4) |
| Mac avec 64 Go | 27 | Qwen3.8 27B (149,4) |
| Mac avec 128 Go | 31 | Qwen3.8 27B (149,4) |
Même 8 Go suffisent à beaucoup : 7 modèles notés y tiennent, et le meilleur d’entre eux, Qwen3.5-9B, obtient 139,5 à notre indice général. Le palier qui compte le plus est celui des 24 Go : 23 modèles y tiennent, dont Qwen3.8 27B (149,4). Au-delà, la mémoire supplémentaire apporte étonnamment peu parmi les modèles notés, car les modèles ouverts suivants sont bien plus gros : Kimi K3, le meilleur modèle ouvert, demande du matériel de serveur.
À quelle distance des meilleurs ?
Le meilleur modèle qui tient sur une carte de 24 Go obtient 149,4. Le meilleur modèle ouvert obtient 157,7, et le meilleur modèle que nous suivons, GPT-6 Astra, 166,6. Une bonne machine à la maison arrive donc à 17,2 points du sommet. Pour les résumés, les brouillons, la traduction et les questions sur vos propres documents, c’est en général suffisant. Pour le raisonnement difficile et le code long, les grands modèles en ligne restent devant.
Ce que supposent ces chiffres
- Une compression en 4 bits, soit environ 0,6 octet par paramètre, plus environ 1,5 Go pour une conversation ordinaire. Les longs documents en demandent davantage.
- Pour qu’un modèle soit rapide, il doit tenir dans la mémoire de la carte graphique. Sinon, il peut déborder sur la mémoire principale de l’ordinateur, mais il écrit alors lentement.
- Sur un Mac à puce Apple, environ 70 % de la mémoire unifiée peut servir à la partie graphique.
- Seuls les modèles dotés d’un score indépendant sont classés ici. Il existe aussi beaucoup de modèles plus petits ou plus récents : l’outil liste les 148 modèles ouverts dont nous connaissons la taille.
Testez votre propre machine avec l’outil Mon PC peut-il le faire tourner ?, et suivez le guide pour faire tourner un modèle sur votre ordinateur.
Les chiffres de cet article sont recalculés à partir de nos données à chaque mise à jour (dernière : 30 sept. 2026). Notre méthode