GPT Audio
À propos de ce modèle
GPT Audio est un modèle d’IA de OpenAI, disponible via l’API depuis le 19 janvier 2026. Il peut lire jusqu’à 128 000 tokens en une seule requête, soit environ 240 pages de texte, et rédiger jusqu’à 16 384 tokens en une seule réponse. En plus du texte, il accepte en entrée de l’audio. Il peut générer de l’audio.
Via l’API, il coûte 2,50 $US par million de tokens en entrée et 10 $US par million de tokens en sortie.
Il peut appeler des outils et des fonctions, ce qui permet aux développeurs de le connecter à un moteur de recherche, une base de données ou d’autres logiciels.
Scores de qualité
Classements →Pas encore évalué. Les résultats de tests indépendants paraissent généralement quelques semaines après la sortie d’un modèle.
Où l’utiliser
Entreprises qui proposent ce modèle via une API : 1. Prix par million de tokens, du moins cher au plus cher.
Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.
L’utiliser dans votre code
Appelez GPT Audio via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "openai/gpt-audio", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="openai/gpt-audio",
messages=[{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "openai/gpt-audio",
messages: [{ role: "user", content: "Bonjour ! Que sais-tu faire ?" }],
});
console.log(reply.choices[0].message.content);Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.
Ce que ça coûte en pratique
- 1 000 réponses de chatbot4,25 $US
- Résumer un document de 100 pages0,135 $US
- Une appli à 10 000 requêtes par jour pendant un mois1 950 $US
Alternatives à prix similaire
| Modèle | Entréei | Sortiei | Contextei | |
|---|---|---|---|---|
Nano Banana Pro (Gemini 3 Pro Image)Google DeepMind | 2 $US | 12 $US | 128K | Comparer avec ⇄ |
Actualités sur OpenAI
Tout voir →Questions fréquentes
- Combien coûte GPT Audio ?
- Via l’API, GPT Audio coûte 2,50 $US par million de tokens en entrée et 10 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 4,25 $US.
- Quelle est la fenêtre de contexte de GPT Audio ?
- GPT Audio peut lire jusqu’à 128 000 tokens en une seule requête, soit environ 240 pages de texte. Il peut rédiger jusqu’à 16 384 tokens en une seule réponse.
- GPT Audio est-il open source ?
- Non. GPT Audio est un modèle fermé : ses poids ne sont pas publiés, on l’utilise donc via les applications et l’API de OpenAI, ou via des fournisseurs cloud.
- Qui a créé GPT Audio ?
- GPT Audio est développé par OpenAI. Il est disponible via l’API depuis le 19 janvier 2026.
- GPT Audio peut-il lire des images ?
- Oui. En plus du texte, il accepte en entrée de l’audio.