Les modèles de raisonnement écrivent une chaîne de réflexion cachée avant de répondre. Cela les rend bien meilleurs en mathématiques, en code et en planification, et chacun de ces tokens cachés est facturé au prix de la sortie. Voici ce que cela représente en chiffres.
La réflexion a conquis le sommet
70 % des modèles textuels que nous suivons savent raisonner, comme 20 des 20 modèles les mieux notés (10 du top 10). Parmi les modèles notés, le modèle de raisonnement médian obtient 148,4 à l’indice général, contre 127,2 pour les modèles qui répondent directement.
Le prix d’une pensée
Les modèles de raisonnement coûtent aussi plus cher au token : leur prix de sortie médian est de 3,75 $US par million de tokens, contre 0,53 $US pour les autres. Et la réflexion elle-même est facturée comme de la sortie. Avec GPT-6 Astra, une réponse qui lit 1 000 tokens et en écrit 500 visibles coûte 0,035 $US. Ajoutez 2 000 tokens de réflexion et elle coûte 0,135 $US ; avec 10 000, un volume que les problèmes difficiles peuvent atteindre, 0,535 $US : 15× le prix de la réponse directe.
| Tokens de réflexion | Par réponse | Pour 1 000 réponses |
|---|---|---|
| 0 | 0,035 $US | 35,00 $US |
| 2 000 | 0,135 $US | 135 $US |
| 10 000 | 0,535 $US | 535 $US |
Quand la réflexion en vaut la peine
- Elle en vaut la peine : mathématiques et logique, planification en plusieurs étapes, code qui doit fonctionner, analyses où une erreur coûte cher.
- Elle n’en vaut pas la peine : réponses courtes, extraction, classement, traduction, conversation légère. Un modèle qui répond directement y est plus rapide et moins cher.
Comment la garder sous contrôle
- Beaucoup de modèles permettent de régler leur niveau de réflexion (un paramètre d’« effort de raisonnement » ou un budget de réflexion). Utilisez le niveau le plus bas qui donne encore de bons résultats.
- Fixez une longueur de sortie maximale, pour qu’une réflexion qui s’emballe ne fasse pas exploser le coût d’une réponse.
- Aiguillez les requêtes : n’envoyez que les plus difficiles à un modèle de raisonnement. Le simulateur de mix de modèles montre l’économie.
- Estimez avant de lancer : le calculateur de coût a un champ pour les tokens de réflexion.
« Sait raisonner » signifie ici que le modèle propose un mode de réflexion selon sa fiche ; beaucoup de modèles permettent de l’activer ou non à chaque requête, et vous ne payez que la réflexion réellement produite.
Les chiffres de cet article sont recalculés à partir de nos données à chaque mise à jour (dernière : 30 sept. 2026). Notre méthode