«¿Cuánto va a costar?» es la primera pregunta antes de poner un modelo de IA frente a los clientes. La respuesta honesta: depende del modelo mucho más que de cualquier otra cosa. Con los precios actuales de este sitio, calculamos tres usos habituales con tres modelos:

  • GPT-6 Astra (OpenAI), el modelo mejor valorado que seguimos (índice general 166,6);
  • GPT-5.6 Sol (OpenAI), el mejor valorado entre los que cuestan como mucho una quinta parte de ese precio (162,0);
  • DeepSeek V4 Flash 0731 (DeepSeek), el modelo más barato que sigue por encima de la mediana de todos los modelos evaluados (154,5, con una mediana de 145,8).

Los tres usos

  • Bot de atención al cliente: 1000 conversaciones al día de unos cuatro mensajes. Cada mensaje vuelve a enviar las instrucciones y toda la conversación, así que una conversación lee unos 6000 tokens y escribe unos 800.
  • Preguntas sobre documentos de la empresa: 300 preguntas al día, cada una respondida a partir de unos 12.000 tokens de fragmentos recuperados, con una respuesta de 400 tokens.
  • Asistente de código para un equipo de unas diez personas: 1500 solicitudes al día, 8000 tokens de código de entrada y 1000 de salida.

La factura mensual

UsoGPT-6 Astra (166,6)GPT-5.6 Sol (162,0)DeepSeek V4 Flash 0731 (154,5)
Bot de atención al cliente3000 US$600 US$10,92 US$
Preguntas sobre documentos de la empresa1260 US$252 US$3,10 US$
Asistente de código (equipo de ~10)5850 US$1170 US$20,88 US$

Costo mensual en dólares estadounidenses (30 días), con el índice general de cada modelo entre paréntesis.

El mismo bot de atención al cliente cuesta 3000 US$ al mes con GPT-6 Astra, 600 US$ con GPT-5.6 Sol y 10,92 US$ con DeepSeek V4 Flash 0731: 275× entre el primero y el último. Los precios por token difieren hasta ese punto, y un producto con mucho uso multiplica cada diferencia por millones de tokens.

A dónde va el dinero

Dos cosas determinan la factura. La primera es lo que el modelo lee: las aplicaciones de chat vuelven a enviar las instrucciones y toda la conversación con cada mensaje, así que una conversación larga cuesta mucho más de lo que sugiere su último mensaje, y las herramientas de documentos leen miles de tokens de contexto por cada pregunta. La segunda es lo que el modelo escribe: con GPT-6 Astra, un token de salida cuesta 5× lo que uno de entrada, y los modelos de razonamiento además escriben tokens de «pensamiento» ocultos que se cobran como salida (consulta lo que cuesta pensar).

Tres formas de reducirla

  • Caché de prompts. Si el 50 % de lo que lee cada conversación de soporte sale de la caché, la factura de GPT-6 Astra baja de 3000 US$ a 2190 US$. Las instrucciones, los ejemplos y los documentos que se repiten son los candidatos evidentes.
  • Una combinación de modelos. Envía el 70 % más sencillo de las conversaciones a DeepSeek V4 Flash 0731 y deja GPT-6 Astra para el resto: 908 US$ al mes en lugar de 3000 US$. Prueba tu propio reparto en el simulador de combinación de modelos.
  • Menos contexto. Resume las conversaciones largas en lugar de reenviarlas completas, y recupera menos fragmentos de tus documentos, pero más pertinentes.

Entonces, ¿qué modelo elegir?

El precio es solo la mitad de la pregunta. Los modelos más baratos puntúan más bajo en las pruebas independientes (154,5 frente a 166,6 en el índice general), y que esa diferencia importe depende por completo de tu tarea. Prueba 30 de tus conversaciones reales con dos o tres candidatos antes de decidir, y usa la calculadora de costos para calcular tus propios volúmenes con cada modelo.

Los precios detrás de estas cifras se actualizan varias veces al día, y esta página se recalcula con ellos.

Las cifras de este artículo se recalculan a partir de nuestros datos con cada actualización (última: 30 sept 2026). Cómo trabajamos