Qwen3 Max Thinking

Alibaba Qwenqwen/qwen3-max-thinkingProveedores: 1
Entradai0,78 US$por millón de tokens
Salidai3,90 US$por millón de tokens
Contextoi256K262.144 tokens
Lanzamiento9 feb 2026Salida máxima: 64K

Sobre este modelo

Qwen3 Max Thinking es un modelo de IA de Alibaba Qwen, disponible a través de la API desde el 9 de febrero de 2026. Puede leer hasta 262.144 tokens en una sola petición, unas 492 páginas de texto, y escribir hasta 65.536 tokens en una sola respuesta.

A través de la API cuesta 0,78 US$ por millón de tokens de entrada y 3,90 US$ por millón de tokens de salida. Su precio está en la media del mercado.

Admite razonamiento extendido: puede «pensar» paso a paso antes de responder, lo que le ayuda en matemáticas, programación y preguntas complejas. Puede llamar a herramientas y funciones, así que los desarrolladores pueden conectarlo a buscadores, bases de datos u otros programas.

Puntuaciones de calidad

Rankings →

Aún sin evaluar. Los resultados de pruebas independientes suelen aparecer unas semanas después del lanzamiento de un modelo.

Datos de benchmarks: Epoch AI, con licencia CC BY 4.0

Dónde usarlo

Empresas que ofrecen este modelo por API: 1. Precios por millón de tokens, del más barato al más caro.

ProveedorEntradaiSalidaiContextoiDisponibilidad (24 h)i
AlibabaOficial
0,78 US$3,90 US$256K99.9%

La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.

Úsalo en tu código

Llama a Qwen3 Max Thinking a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "qwen/qwen3-max-thinking", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'

El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.

Lo que cuesta en la práctica

  • 1000 respuestas de chat
    ≈ 500 tokens de entrada y 300 de salida cada una
    1,56 US$
  • Resumir un documento de 100 páginas
    ≈ 50.000 tokens de entrada y 1000 de salida
    0,043 US$
  • Una app con 10.000 peticiones al día durante un mes
    ≈ 1000 tokens de entrada y 400 de salida cada una
    702 US$

Calculadora de costos →

Alternativas de precio similar

ModeloEntradaiSalidaiContextoi
Aion-2.0Aion Labs
0,80 US$1,60 US$128KComparar con ⇄
Gemini 3.8 FlashGoogle DeepMind
0,75 US$3,75 US$1MComparar con ⇄
0,75 US$4,50 US$400KComparar con ⇄
0,74 US$2,96 US$256KComparar con ⇄
0,83 US$2,50 US$1MComparar con ⇄
0,66 US$1,98 US$1MComparar con ⇄

Noticias sobre Alibaba Qwen

Ver todo →

Preguntas frecuentes

¿Cuánto cuesta Qwen3 Max Thinking?
A través de la API, Qwen3 Max Thinking cuesta 0,78 US$ por millón de tokens de entrada y 3,90 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 1,56 US$.
¿Cuál es la ventana de contexto de Qwen3 Max Thinking?
Qwen3 Max Thinking puede leer hasta 262.144 tokens en una sola petición, unas 492 páginas de texto. Puede escribir hasta 65.536 tokens en una sola respuesta.
¿Qwen3 Max Thinking es de código abierto?
No. Qwen3 Max Thinking es un modelo cerrado: sus pesos no están publicados, así que se usa a través de las aplicaciones y la API de Alibaba Qwen o de proveedores en la nube.
¿Quién ha creado Qwen3 Max Thinking?
Qwen3 Max Thinking lo desarrolla Alibaba Qwen. Está disponible a través de la API desde el 9 de febrero de 2026.
¿Qwen3 Max Thinking puede leer imágenes?
No. Qwen3 Max Thinking solo acepta texto como entrada.
¿Qué alternativas hay a Qwen3 Max Thinking?
Entre los modelos de otras empresas con un precio parecido están Aion-2.0, Gemini 3.8 Flash y GPT-5.4 Mini. Puedes compararlos lado a lado en esta página.