Qwen3 VL 30B A3B Thinking
Sobre este modelo
Qwen3 VL 30B A3B Thinking es un modelo de IA de Alibaba Qwen, disponible a través de la API desde el 6 de octubre de 2025. Puede leer hasta 262.144 tokens en una sola petición, unas 492 páginas de texto, y escribir hasta 32.768 tokens en una sola respuesta. Además de texto, acepta como entrada imágenes.
A través de la API cuesta 0,20 US$ por millón de tokens de entrada y 2,40 US$ por millón de tokens de salida. Su precio está en la media del mercado.
Admite razonamiento extendido: puede «pensar» paso a paso antes de responder, lo que le ayuda en matemáticas, programación y preguntas complejas. Puede llamar a herramientas y funciones, así que los desarrolladores pueden conectarlo a buscadores, bases de datos u otros programas. Sus pesos están publicados abiertamente (Qwen/Qwen3-VL-30B-A3B-Thinking), así que también se puede descargar y ejecutar en tu propio hardware.
Puntuaciones de calidad
Rankings →Aún sin evaluar. Los resultados de pruebas independientes suelen aparecer unas semanas después del lanzamiento de un modelo.
Dónde usarlo
Empresas que ofrecen este modelo por API: 2. Precios por millón de tokens, del más barato al más caro.
| Proveedor | Entradai | Salidai | Contextoi | Disponibilidad (24 h)i |
|---|---|---|---|---|
SiliconFlowEl más baratofp8 | 0,29 US$ | 1 US$ | 256K | 99.8% |
AlibabaOficial | 0,20 US$ | 2,40 US$ | 128K | 99.9% |
La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.
Úsalo en tu código
Llama a Qwen3 VL 30B A3B Thinking a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "qwen/qwen3-vl-30b-a3b-thinking", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="qwen/qwen3-vl-30b-a3b-thinking",
messages=[{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "qwen/qwen3-vl-30b-a3b-thinking",
messages: [{ role: "user", content: "¡Hola! ¿Qué sabes hacer?" }],
});
console.log(reply.choices[0].message.content);El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.
Lo que cuesta en la práctica
- 1000 respuestas de chat0,82 US$
- Resumir un documento de 100 páginas0,012 US$
- Una app con 10.000 peticiones al día durante un mes348 US$
Alternativas de precio similar
| Modelo | Entradai | Salidai | Contextoi | |
|---|---|---|---|---|
GPT-5.6 Luna ProOpenAI | 0,20 US$ | 1,20 US$ | 1.1M | Comparar con ⇄ |
| 0,20 US$ | 0,20 US$ | 128K | Comparar con ⇄ | |
Step 3.7 FlashStepFun | 0,20 US$ | 1,15 US$ | 256K | Comparar con ⇄ |
Ministral 3 14B 2512Mistral AI | 0,20 US$ | 0,20 US$ | 256K | Comparar con ⇄ |
MiniMax M2.7MiniMax | 0,21 US$ | 0,84 US$ | 200K | Comparar con ⇄ |
DeepSeek V4 Flash Vision ExpDeepSeek | 0,22 US$ | 0,65 US$ | 1M | Comparar con ⇄ |
Noticias sobre Alibaba Qwen
Ver todo →Preguntas frecuentes
- ¿Cuánto cuesta Qwen3 VL 30B A3B Thinking?
- A través de la API, Qwen3 VL 30B A3B Thinking cuesta 0,20 US$ por millón de tokens de entrada y 2,40 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 0,82 US$.
- ¿Cuál es la ventana de contexto de Qwen3 VL 30B A3B Thinking?
- Qwen3 VL 30B A3B Thinking puede leer hasta 262.144 tokens en una sola petición, unas 492 páginas de texto. Puede escribir hasta 32.768 tokens en una sola respuesta.
- ¿Qwen3 VL 30B A3B Thinking es de código abierto?
- Sí. Sus pesos están publicados (Qwen/Qwen3-VL-30B-A3B-Thinking), así que puedes descargarlo y ejecutarlo en tu propio hardware, o usarlo a través de uno de sus 2 proveedores de API.
- ¿Quién ha creado Qwen3 VL 30B A3B Thinking?
- Qwen3 VL 30B A3B Thinking lo desarrolla Alibaba Qwen. Está disponible a través de la API desde el 6 de octubre de 2025.
- ¿Qwen3 VL 30B A3B Thinking puede leer imágenes?
- Sí. Además de texto, acepta como entrada imágenes.
- ¿Qué alternativas hay a Qwen3 VL 30B A3B Thinking?
- Entre los modelos de otras empresas con un precio parecido están GPT-5.6 Luna Pro, Nemotron 3.5 Content Safety y Step 3.7 Flash. Puedes compararlos lado a lado en esta página.