La ventana de contexto es la cantidad de texto que un modelo puede tener en cuenta a la vez: tus instrucciones, la conversación hasta el momento y los documentos que añadas, todo medido en tokens. Decide si puedes dar a un modelo un contrato entero, una base de código o un año de tickets de soporte, o si tienes que trocearlos antes. Así están los 328 modelos de texto que seguimos.
La mayoría de los modelos ya lee mucho
La ventana de contexto mediana es de 256K tokens, unas 492 páginas impresas. El 90 % de los modelos lee al menos 128K tokens, y el 32 % lee un millón o más, la extensión de varias novelas largas.
| Ventana de contexto | Modelos | Proporción |
|---|---|---|
| ≤ 32K | 19 | 6 % |
| 32K–128K | 74 | 23 % |
| 128K–512K | 130 | 40 % |
| ≥ 1M | 105 | 32 % |
Las ventanas más grandes
| Modelo | Empresa | Ventana de contexto | Aprox. |
|---|---|---|---|
| Grok 4.20 Multi-Agent | xAI | 2M | 3750 páginas |
| Grok 4.20 | xAI | 2M | 3750 páginas |
| Llama 4 Scout | Meta | 1.3M | 2458 páginas |
| GPT-6.1 Sol Pro | OpenAI | 1.1M | 1969 páginas |
| GPT-6.1 Sol | OpenAI | 1.1M | 1969 páginas |
Leer no es gratis
Una ventana más grande permite enviar más, y cada token que envías se cobra. Llenar toda la ventana de GPT-6 Astra, el modelo mejor valorado que seguimos, cuesta unos 10,50 US$ solo en entrada, por una única solicitud. Con DeepSeek V4 Flash 0731, el modelo más barato de nuestra lista que lee un millón de tokens, la misma ventana llena cuesta 0,019 US$. En un chat, donde el historial se vuelve a enviar con cada mensaje, esas cantidades se repiten en cada turno.
Más grande no siempre es mejor
Varias investigaciones han comprobado que los modelos aprovechan mejor lo que está al principio y al final de un texto largo que lo que queda enterrado en medio. Para muchas tareas, un buen paso de búsqueda que envía las diez páginas adecuadas es mejor que pegar mil: es más barato, más rápido y a menudo más preciso. Las ventanas largas compensan cuando todo el texto importa a la vez, por ejemplo para detectar contradicciones en un contrato largo, seguir una base de código grande o resumir un libro.
¿Cuánto necesitas?
- Chat y atención al cliente: de 32K a 128K tokens es más que suficiente, siempre que resumas los mensajes antiguos.
- Preguntas sobre documentos: 128K permiten trabajar con varios documentos largos a la vez; más allá, envía solo los fragmentos útiles.
- Bases de código, libros o expedientes completos: mira los modelos que leen un millón de tokens o más, y comprueba cuánto cuesta una ventana llena.
La página de los mejores modelos de contexto largo los clasifica con sus precios, y el glosario explica el término en dos líneas.
Las cifras de este artículo se recalculan a partir de nuestros datos con cada actualización (última: 30 sept 2026). Cómo trabajamos