GPT Audio
Sobre este modelo
GPT Audio es un modelo de IA de OpenAI, disponible a través de la API desde el 19 de enero de 2026. Puede leer hasta 128.000 tokens en una sola petición, unas 240 páginas de texto, y escribir hasta 16.384 tokens en una sola respuesta. Además de texto, acepta como entrada audio. Puede generar audio.
A través de la API cuesta 2,50 US$ por millón de tokens de entrada y 10 US$ por millón de tokens de salida.
Puede llamar a herramientas y funciones, así que los desarrolladores pueden conectarlo a buscadores, bases de datos u otros programas.
Puntuaciones de calidad
Rankings →Aún sin evaluar. Los resultados de pruebas independientes suelen aparecer unas semanas después del lanzamiento de un modelo.
Dónde usarlo
Empresas que ofrecen este modelo por API: 1. Precios por millón de tokens, del más barato al más caro.
La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.
Úsalo en tu código
Llama a GPT Audio a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "openai/gpt-audio", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="openai/gpt-audio",
messages=[{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "openai/gpt-audio",
messages: [{ role: "user", content: "¡Hola! ¿Qué sabes hacer?" }],
});
console.log(reply.choices[0].message.content);El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.
Lo que cuesta en la práctica
- 1000 respuestas de chat4,25 US$
- Resumir un documento de 100 páginas0,135 US$
- Una app con 10.000 peticiones al día durante un mes1950 US$
Alternativas de precio similar
| Modelo | Entradai | Salidai | Contextoi | |
|---|---|---|---|---|
Nano Banana Pro (Gemini 3 Pro Image)Google DeepMind | 2 US$ | 12 US$ | 128K | Comparar con ⇄ |
Noticias sobre OpenAI
Ver todo →Preguntas frecuentes
- ¿Cuánto cuesta GPT Audio?
- A través de la API, GPT Audio cuesta 2,50 US$ por millón de tokens de entrada y 10 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 4,25 US$.
- ¿Cuál es la ventana de contexto de GPT Audio?
- GPT Audio puede leer hasta 128.000 tokens en una sola petición, unas 240 páginas de texto. Puede escribir hasta 16.384 tokens en una sola respuesta.
- ¿GPT Audio es de código abierto?
- No. GPT Audio es un modelo cerrado: sus pesos no están publicados, así que se usa a través de las aplicaciones y la API de OpenAI o de proveedores en la nube.
- ¿Quién ha creado GPT Audio?
- GPT Audio lo desarrolla OpenAI. Está disponible a través de la API desde el 19 de enero de 2026.
- ¿GPT Audio puede leer imágenes?
- Sí. Además de texto, acepta como entrada audio.