La fenêtre de contexte, c’est la quantité de texte qu’un modèle peut prendre en compte d’un coup : vos instructions, la conversation en cours et les documents éventuels, le tout compté en tokens. Elle détermine si vous pouvez confier à un modèle un contrat entier, une base de code ou une année de tickets de support, ou s’il faut d’abord les découper. Voici où en sont les 328 modèles textuels que nous suivons.

La plupart des modèles lisent désormais beaucoup

La fenêtre de contexte médiane est de 256K tokens, soit environ 492 pages imprimées. 90 % des modèles lisent au moins 128K tokens, et 32 % en lisent un million ou plus, la longueur de plusieurs longs romans.

Fenêtre de contexteModèlesPart
≤ 32K196 %
32K–128K7423 %
128K–512K13040 %
≥ 1M10532 %

Les plus grandes fenêtres

ModèleEntrepriseFenêtre de contexteEnviron
Grok 4.20 Multi-AgentxAI2M3 750 pages
Grok 4.20xAI2M3 750 pages
Llama 4 ScoutMeta1.3M2 458 pages
GPT-6.1 Sol ProOpenAI1.1M1 969 pages
GPT-6.1 SolOpenAI1.1M1 969 pages

Lire n’est pas gratuit

Une fenêtre plus grande permet d’envoyer plus, et chaque token envoyé est facturé. Remplir toute la fenêtre de GPT-6 Astra, le modèle le mieux noté que nous suivons, coûte environ 10,50 $US rien qu’en entrée, pour une seule requête. Avec DeepSeek V4 Flash 0731, le modèle le moins cher de notre liste qui lit un million de tokens, la même fenêtre pleine coûte 0,019 $US. Dans un chat, où l’historique est renvoyé à chaque message, ces montants reviennent à chaque échange.

Plus grand n’est pas toujours mieux

Plusieurs travaux de recherche ont montré que les modèles exploitent mieux ce qui se trouve au début et à la fin d’un long texte que ce qui est enfoui au milieu. Pour beaucoup de tâches, une bonne étape de recherche qui envoie les dix bonnes pages vaut mieux que d’en coller mille : c’est moins cher, plus rapide et souvent plus juste. Les longues fenêtres se justifient quand tout le texte compte à la fois, par exemple pour repérer les contradictions d’un long contrat, suivre une grande base de code ou résumer un livre.

De combien avez-vous besoin ?

  • Chat et support client : 32K à 128K tokens suffisent largement, à condition de résumer les anciens messages.
  • Questions sur des documents : 128K permettent de traiter quelques longs documents d’un coup ; au-delà, envoyez seulement les passages utiles.
  • Bases de code, livres ou dossiers entiers : regardez les modèles qui lisent un million de tokens ou plus, et vérifiez ce que coûte une fenêtre pleine.

La page des meilleurs modèles à long contexte les classe avec leurs prix, et le glossaire explique le terme en deux lignes.

Les chiffres de cet article sont recalculés à partir de nos données à chaque mise à jour (dernière : 30 sept. 2026). Notre méthode