Les prix de l’IA couvrent un éventail énorme. Parmi les 136 modèles payants dotés d’un score indépendant, le moins cher coûte 0,022 $US par million de tokens et le plus cher 67,50 $US : 3 103× plus. Leurs scores, eux, sont bien plus proches. Que paie-t-on vraiment avec cet argent en plus ?

Deux précisions sur les chiffres. Les prix sont « mixtes » : ils supposent trois tokens lus pour chaque token écrit, un ratio typique pour le chat et le travail sur documents. Les scores sont l’indice général des tests indépendants d’Epoch AI, une échelle unique où plus haut signifie plus capable.

La frontière du rapport qualité-prix

Classez tous les modèles par prix et ne gardez que ceux qui obtiennent un meilleur score que tous les modèles moins chers : c’est la frontière du rapport qualité-prix. Chaque modèle qui y figure est le plus capable qu’on puisse obtenir à son prix ; tous les autres sont battus par un modèle moins cher. Aujourd’hui, 9 modèles en font partie.

ModèleEntrepriseIndice généralPrix mixte
Mistral NemoMistral AI118,60,022 $US
gpt-oss-20bOpenAI137,80,036 $US
Qwen3.7 FlashAlibaba Qwen144,60,055 $US
DeepSeek V4 Flash 0731DeepSeek154,50,094 $US
GPT-5.6 LunaOpenAI156,30,45 $US
Gemini 3.7 FlashGoogle DeepMind157,71,50 $US
GPT-5.6 SolOpenAI162,04 $US
Claude Opus 5Anthropic162,710 $US
GPT-6 AstraOpenAI166,620 $US

Des rendements décroissants

Les premiers dollars achètent beaucoup. Pour 0,25 $US ou moins par million de tokens, le meilleur modèle est DeepSeek V4 Flash 0731 (154,5) ; sous 1 $US, GPT-5.6 Luna (156,3) ; sous 5 $US, GPT-5.6 Sol (162,0). Le modèle en tête, GPT-6 Astra, obtient 166,6 pour 20 $US.

Autrement dit, les 10,3 derniers points de l’indice coûtent 44× le prix du meilleur modèle sous 1 $US. Pour la plupart des usages quotidiens, cet écart se remarque à peine ; sur les problèmes les plus difficiles, il peut faire la différence entre une bonne et une mauvaise réponse.

Un prix plus élevé n’est pas non plus une garantie : le modèle le plus cher que nous suivons, GPT-5.4 Pro (67,50 $US), obtient 159,1, moins que GPT-5.6 Sol, qui coûte 17× moins cher.

Quand payer plus en vaut la peine

  • Le raisonnement difficile, les mathématiques avancées et le code complexe, où les meilleurs modèles sont nettement devant.
  • Les petits volumes : à quelques centaines de requêtes par jour, même un modèle haut de gamme coûte peu.
  • Les erreurs coûteuses : brouillons juridiques, médicaux ou financiers, où une seule mauvaise réponse efface toute économie.

Quand ce n’est pas le cas

  • Les tâches simples en grand volume : tri, extraction, réponses courtes, premiers jets relus de toute façon par une personne.
  • Les usages mixtes : envoyez les requêtes simples à un modèle du bas de la frontière et gardez un modèle de pointe pour le reste. Le simulateur de mix de modèles montre l’économie.

Ce que l’indice ne dit pas, c’est comment un modèle se comporte sur votre propre tâche, dans votre langue, avec vos données. Servez-vous-en pour établir une présélection, puis testez les finalistes. Les classements détaillent les scores par domaine : code, mathématiques, sciences et connaissances factuelles.

Les chiffres de cet article sont recalculés à partir de nos données à chaque mise à jour (dernière : 30 sept. 2026). Notre méthode