Los precios de la IA abarcan un rango enorme. Entre los 136 modelos de pago con una puntuación independiente, el más barato cuesta 0,022 US$ por millón de tokens y el más caro 67,50 US$: 3103× más. Sus puntuaciones, en cambio, están mucho más cerca. ¿Qué se compra realmente con ese dinero extra?
Dos aclaraciones sobre las cifras. Los precios son «combinados»: suponen tres tokens leídos por cada token escrito, una proporción típica en chat y trabajo con documentos. Las puntuaciones son el índice general de las pruebas independientes de Epoch AI, una escala única en la que más alto significa más capaz.
La frontera de la relación calidad-precio
Ordena todos los modelos por precio y quédate solo con los que puntúan más que todos los modelos más baratos: esa es la frontera de la relación calidad-precio. Cada modelo que aparece en ella es el más capaz que se puede obtener por su precio; todos los demás los supera alguno más barato. Hoy forman parte de ella 9 modelos.
| Modelo | Empresa | Índice general | Precio combinado |
|---|---|---|---|
| Mistral Nemo | Mistral AI | 118,6 | 0,022 US$ |
| gpt-oss-20b | OpenAI | 137,8 | 0,036 US$ |
| Qwen3.7 Flash | Alibaba Qwen | 144,6 | 0,055 US$ |
| DeepSeek V4 Flash 0731 | DeepSeek | 154,5 | 0,094 US$ |
| GPT-5.6 Luna | OpenAI | 156,3 | 0,45 US$ |
| Gemini 3.7 Flash | Google DeepMind | 157,7 | 1,50 US$ |
| GPT-5.6 Sol | OpenAI | 162,0 | 4 US$ |
| Claude Opus 5 | Anthropic | 162,7 | 10 US$ |
| GPT-6 Astra | OpenAI | 166,6 | 20 US$ |
Rendimientos decrecientes
Los primeros dólares compran mucho. Por 0,25 US$ o menos por millón de tokens, el mejor modelo es DeepSeek V4 Flash 0731 (154,5); por debajo de 1 US$, GPT-5.6 Luna (156,3); por debajo de 5 US$, GPT-5.6 Sol (162,0). El modelo líder, GPT-6 Astra, obtiene 166,6 por 20 US$.
Dicho de otro modo, los últimos 10,3 puntos del índice cuestan 44× lo que el mejor modelo por debajo de 1 US$. En la mayoría de los usos diarios esa diferencia apenas se nota; en los problemas más difíciles, puede separar una respuesta correcta de una equivocada.
Un precio más alto tampoco es una garantía: el modelo más caro que seguimos, GPT-5.4 Pro (67,50 US$), obtiene 159,1, menos que GPT-5.6 Sol, que cuesta 17× menos.
Cuándo vale la pena pagar más
- El razonamiento difícil, las matemáticas avanzadas y el código complejo, donde los mejores modelos van claramente por delante.
- Los volúmenes bajos: con unos cientos de solicitudes al día, incluso un modelo de gama alta cuesta poco.
- Los errores caros: borradores legales, médicos o financieros, donde una sola respuesta equivocada anula cualquier ahorro.
Cuándo no
- Las tareas sencillas y de gran volumen: clasificar, extraer datos, respuestas cortas, primeros borradores que una persona revisa de todos modos.
- Los usos mixtos: envía las solicitudes sencillas a un modelo del extremo barato de la frontera y deja un modelo de primer nivel para el resto. El simulador de combinación de modelos muestra el ahorro.
Lo que el índice no dice es cómo rinde un modelo en tu propia tarea, en tu idioma y con tus datos. Úsalo para hacer una preselección y luego prueba a los finalistas. Las clasificaciones desglosan las puntuaciones por ámbito: código, matemáticas, ciencias y conocimientos.
Las cifras de este artículo se recalculan a partir de nuestros datos con cada actualización (última: 30 sept 2026). Cómo trabajamos