GLM 5.3 Flash
Dónde se sitúa
La calidad en pruebas independientes frente al precio, junto a otros 135 modelos. Más arriba significa más capaz; más a la izquierda, más barato.
Sobre este modelo
GLM 5.3 Flash es un modelo de IA de Z.ai (Zhipu), disponible a través de la API desde el 26 de agosto de 2026. Puede leer hasta 1.048.576 tokens en una sola petición, unas 1966 páginas de texto, y escribir hasta 943.717 tokens en una sola respuesta. Además de texto, acepta como entrada imágenes y video.
A través de la API cuesta 0,15 US$ por millón de tokens de entrada y 0,50 US$ por millón de tokens de salida. Su precio lo sitúa entre los modelos más asequibles que seguimos, lo que lo convierte en una buena opción para tareas de gran volumen.
Admite razonamiento extendido: puede «pensar» paso a paso antes de responder, lo que le ayuda en matemáticas, programación y preguntas complejas. Puede llamar a herramientas y funciones, así que los desarrolladores pueden conectarlo a buscadores, bases de datos u otros programas. Sus pesos están publicados abiertamente (zai-org/GLM-5.3-Flash), así que también se puede descargar y ejecutar en tu propio hardware.
Puntuaciones de calidad
Rankings →- GPQA DiamondPreguntas de opción múltiple muy difíciles de biología, física y química, escritas por expertos con doctorado. Responder al azar da un 25 %.90.2%N.º 31 de 116
- Matemáticas AIMEProblemas de matemáticas de nivel de competición, al estilo del American Invitational Mathematics Examination. Porcentaje resuelto.93.9%N.º 32 de 112
- FrontierMathProblemas de matemáticas originales e inéditos escritos por matemáticos profesionales, desde nivel avanzado hasta nivel de investigación. Porcentaje resuelto.55.8%N.º 36 de 73
Dónde usarlo
Empresas que ofrecen este modelo por API: 33. Precios por millón de tokens, del más barato al más caro.
| Proveedor | Entradai | Salidai | Contextoi | Disponibilidad (24 h)i |
|---|---|---|---|---|
OpenInferenceEl más baratofp4 | 0,02 US$ | 0,30 US$ | 1M | 98.1% |
DeepInfrafp4 | 0,075 US$ | 0,25 US$ | 1M | 99.6% |
Novitafp8 | 0,084 US$ | 0,28 US$ | 1M | 98.9% |
GMICloudfp8 | 0,09 US$ | 0,30 US$ | 1M | 99.2% |
AtlasCloudfp8 | 0,12 US$ | 0,39 US$ | 1M | 97.2% |
Relace | 0,025 US$ | 0,50 US$ | 1M | 99.7% |
InferenceNetfp4 | 0,10 US$ | 0,45 US$ | 1M | 99.2% |
Decartfp4 | 0,13 US$ | 0,43 US$ | 1M | 99.1% |
StreamLakefp8 | 0,13 US$ | 0,43 US$ | 1M | 97.1% |
Phalafp8 | 0,13 US$ | 0,43 US$ | 1M | 98.9% |
Near AIfp8 | 0,13 US$ | 0,44 US$ | 1M | 98.8% |
Io Netfp8 | 0,14 US$ | 0,46 US$ | 256K | 96.8% |
Inceptronfp8 | 0,15 US$ | 0,45 US$ | 1M | 97.6% |
Sail Researchfp8 | 0,045 US$ | 0,60 US$ | 1M | 99.6% |
Modalnvfp4 | 0,15 US$ | 0,50 US$ | 1M | 99.6% |
BaseTenfp8 | 0,15 US$ | 0,50 US$ | 1M | 99.6% |
Crusoefp4 | 0,15 US$ | 0,50 US$ | 1M | 99.6% |
CoreWeavenvfp4 | 0,15 US$ | 0,50 US$ | 1M | 99.7% |
Fireworks | 0,15 US$ | 0,50 US$ | 1M | 99.1% |
Friendli | 0,15 US$ | 0,50 US$ | 1M | 96.9% |
SiliconFlowfp8 | 0,15 US$ | 0,50 US$ | 1M | 98.6% |
DigitalOcean | 0,15 US$ | 0,50 US$ | 1M | 99.7% |
Together | 0,15 US$ | 0,50 US$ | 1M | 99.8% |
Reka | 0,15 US$ | 0,50 US$ | 256K | 99.7% |
Parasailfp8 | 0,15 US$ | 0,50 US$ | 1M | 99.6% |
BaseTenfp8 | 0,15 US$ | 0,50 US$ | 1M | 99.6% |
Venice | 0,15 US$ | 0,50 US$ | 1M | 98.8% |
Z.AIOficialfp8 | 0,15 US$ | 0,50 US$ | 1M | 99.3% |
Morphfp8 | 0,15 US$ | 0,54 US$ | 1M | 97.6% |
NextBitfp8 | 0,17 US$ | 0,55 US$ | 1M | 99.9% |
Fireworks | 0,23 US$ | 0,75 US$ | 1M | 99.3% |
Wafer | 0,61 US$ | 0,50 US$ | 1M | 99.7% |
Cloudflare | 0,30 US$ | 1 US$ | 1M | 99.0% |
La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.
Úsalo en tu código
Llama a GLM 5.3 Flash a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "z-ai/glm-5.3-flash", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="z-ai/glm-5.3-flash",
messages=[{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "z-ai/glm-5.3-flash",
messages: [{ role: "user", content: "¡Hola! ¿Qué sabes hacer?" }],
});
console.log(reply.choices[0].message.content);El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.
Lo que cuesta en la práctica
- 1000 respuestas de chat0,225 US$
- Resumir un documento de 100 páginas0,008 US$
- Una app con 10.000 peticiones al día durante un mes105 US$
Alternativas de precio similar
| Modelo | Entradai | Salidai | Contextoi | |
|---|---|---|---|---|
Perceptron Mk1.5Perceptron | 0,15 US$ | 1,50 US$ | 36K | Comparar con ⇄ |
Qwen3.8 Omni FlashAlibaba Qwen | 0,15 US$ | 0,47 US$ | 1M | Comparar con ⇄ |
MiMo-V2.6-FlashXiaomi | 0,14 US$ | 0,28 US$ | 1M | Comparar con ⇄ |
Mistral Small 4Mistral AI | 0,15 US$ | 0,60 US$ | 256K | Comparar con ⇄ |
Solar Pro 3Upstage | 0,15 US$ | 0,60 US$ | 128K | Comparar con ⇄ |
Command R (08-2024)Cohere | 0,15 US$ | 0,60 US$ | 128K | Comparar con ⇄ |
Noticias sobre Z.ai (Zhipu)
Ver todo →Preguntas frecuentes
- ¿Cuánto cuesta GLM 5.3 Flash?
- A través de la API, GLM 5.3 Flash cuesta 0,15 US$ por millón de tokens de entrada y 0,50 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 0,225 US$.
- ¿Cuál es la ventana de contexto de GLM 5.3 Flash?
- GLM 5.3 Flash puede leer hasta 1.048.576 tokens en una sola petición, unas 1966 páginas de texto. Puede escribir hasta 943.717 tokens en una sola respuesta.
- ¿GLM 5.3 Flash es de código abierto?
- Sí. Sus pesos están publicados (zai-org/GLM-5.3-Flash), así que puedes descargarlo y ejecutarlo en tu propio hardware, o usarlo a través de uno de sus 33 proveedores de API.
- ¿Quién ha creado GLM 5.3 Flash?
- GLM 5.3 Flash lo desarrolla Z.ai (Zhipu). Está disponible a través de la API desde el 26 de agosto de 2026.
- ¿Qué tan bueno es GLM 5.3 Flash?
- GLM 5.3 Flash tiene un índice general de 151,9 en las pruebas independientes de Epoch AI, el puesto n.º 38 de 136 modelos que seguimos.
- ¿GLM 5.3 Flash puede leer imágenes?
- Sí. Además de texto, acepta como entrada imágenes y video.
- ¿Qué alternativas hay a GLM 5.3 Flash?
- Entre los modelos de otras empresas con un precio parecido están Perceptron Mk1.5, Qwen3.8 Omni Flash y MiMo-V2.6-Flash. Puedes compararlos lado a lado en esta página.