GLM 5.2
Où il se situe
La qualité aux tests indépendants face au prix, parmi 135 autres modèles. Plus haut signifie plus performant, plus à gauche moins cher.
À propos de ce modèle
GLM 5.2 est un modèle d’IA de Z.ai (Zhipu), disponible via l’API depuis le 16 juin 2026. Il peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte, et rédiger jusqu’à 943 718 tokens en une seule réponse.
Via l’API, il coûte 0,14 $US par million de tokens en entrée et 3,99 $US par million de tokens en sortie. Son prix se situe dans la moyenne du marché.
Il prend en charge le raisonnement étendu : il peut « réfléchir » étape par étape avant de répondre, ce qui l’aide en mathématiques, en code et sur les questions complexes. Il peut appeler des outils et des fonctions, ce qui permet aux développeurs de le connecter à un moteur de recherche, une base de données ou d’autres logiciels. Ses poids sont publiés ouvertement (zai-org/GLM-5.2) : il peut donc aussi être téléchargé et exécuté sur votre propre matériel.
Scores de qualité
Classements →- SWE-bench VerifiedLe modèle sait-il corriger de vrais bugs dans de vrais projets logiciels open source ? Part des tâches résolues.78.7%n°3 sur 28
- GPQA DiamondQuestions à choix multiples très difficiles en biologie, physique et chimie, rédigées par des docteurs. Répondre au hasard donne 25 %.91.9%n°17 sur 116
- Maths AIMEProblèmes de mathématiques de niveau concours, dans le style de l’AIME américain. Part des problèmes résolus.86.4%n°54 sur 112
- FrontierMathProblèmes de mathématiques inédits écrits par des mathématiciens professionnels, du niveau avancé au niveau recherche. Part résolue.59.2%n°31 sur 73
- SimpleQA VerifiedQuestions factuelles courtes. Mesure à quelle fréquence le modèle donne le bon fait au lieu d’inventer.34.2%n°46 sur 69
Où l’utiliser
Entreprises qui proposent ce modèle via une API : 32. Prix par million de tokens, du moins cher au plus cher.
| Fournisseur | Entréei | Sortiei | Contextei | Disponibilité (24 h)i |
|---|---|---|---|---|
DecartLe moins chermxfp4 | 0,49 $US | 1,54 $US | 1M | 99.2% |
DeepInfrafp4 | 0,56 $US | 1,80 $US | 1M | 99.1% |
StreamLakefp8 | 0,64 $US | 2,02 $US | 1M | 98.8% |
Novitafp8 | 0,65 $US | 2,04 $US | 1M | 99.2% |
DigitalOcean | 0,70 $US | 2,20 $US | 256K | 99.7% |
Inceptronfp4 | 0,75 $US | 2,40 $US | 1M | 99.0% |
CoreWeavefp4 | 0,76 $US | 2,42 $US | 1M | 97.1% |
AtlasCloudfp8 | 0,94 $US | 2,95 $US | 1M | 99.3% |
Alibabafp8 | 0,97 $US | 3,04 $US | 1M | 99.6% |
Relace | 0,12 $US | 4 $US | 1M | 99.9% |
Wafer | 0,14 $US | 3,99 $US | 1M | 99.8% |
Phalafp8 | 1,26 $US | 3 $US | 1M | 99.6% |
SiliconFlowfp8 | 1,19 $US | 3,74 $US | 1M | 96.5% |
Cloudflare | 1,18 $US | 4,40 $US | 256K | 100.0% |
Mistralnvfp4 | 1,40 $US | 4,40 $US | 1M | 99.9% |
Reka | 1,40 $US | 4,40 $US | 1M | 98.6% |
BaseTenfp8 | 1,40 $US | 4,40 $US | 1M | 99.9% |
Together | 1,40 $US | 4,40 $US | 1M | 99.5% |
Baidufp8 | 1,40 $US | 4,40 $US | 1M | 99.8% |
Fireworks | 1,40 $US | 4,40 $US | 1M | 35.1% |
BaseTenfp8 | 1,40 $US | 4,40 $US | 1M | 99.8% |
Venicefp8 | 1,40 $US | 4,40 $US | 1M | 99.4% |
GMICloudfp8 | 1,40 $US | 4,40 $US | 1M | 99.0% |
Parasailfp4 | 1,40 $US | 4,40 $US | 256K | 99.5% |
Friendli | 1,40 $US | 4,40 $US | 1M | 99.6% |
Z.AIOfficielfp8 | 1,40 $US | 4,40 $US | 1M | 99.5% |
Mistral | 1,54 $US | 4,84 $US | 1M | 99.9% |
BaseTenfp8 | 2,10 $US | 6,60 $US | 1M | 99.8% |
BaseTenfp8 | 2,10 $US | 6,60 $US | 1M | 99.8% |
Alibabafp8 | 2,31 $US | 7,26 $US | 1M | 98.6% |
Baidufp4 | 2,25 $US | 7,88 $US | 1M | 100.0% |
Decartfp4 | 2,25 $US | 8 $US | 1M | 100.0% |
Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.
L’utiliser dans votre code
Appelez GLM 5.2 via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "z-ai/glm-5.2", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="z-ai/glm-5.2",
messages=[{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "z-ai/glm-5.2",
messages: [{ role: "user", content: "Bonjour ! Que sais-tu faire ?" }],
});
console.log(reply.choices[0].message.content);Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.
Ce que ça coûte en pratique
- 1 000 réponses de chatbot1,27 $US
- Résumer un document de 100 pages0,011 $US
- Une appli à 10 000 requêtes par jour pendant un mois522 $US
Alternatives à prix similaire
| Modèle | Entréei | Sortiei | Contextei | |
|---|---|---|---|---|
MiMo-V2.6-FlashXiaomi | 0,14 $US | 0,28 $US | 1M | Comparer avec ⇄ |
Perceptron Mk1.5Perceptron | 0,15 $US | 1,50 $US | 36K | Comparer avec ⇄ |
Qwen3.8 Omni FlashAlibaba Qwen | 0,15 $US | 0,47 $US | 1M | Comparer avec ⇄ |
Hy3Tencent | 0,13 $US | 0,53 $US | 256K | Comparer avec ⇄ |
GPT-5.6 Luna ProOpenAI | 0,20 $US | 1,20 $US | 1.1M | Comparer avec ⇄ |
DeepSeek V4 Flash 0423DeepSeek | 0,14 $US | 0,28 $US | 1M | Comparer avec ⇄ |
Actualités sur Z.ai (Zhipu)
Tout voir →Questions fréquentes
- Combien coûte GLM 5.2 ?
- Via l’API, GLM 5.2 coûte 0,14 $US par million de tokens en entrée et 3,99 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 1,27 $US.
- Quelle est la fenêtre de contexte de GLM 5.2 ?
- GLM 5.2 peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte. Il peut rédiger jusqu’à 943 718 tokens en une seule réponse.
- GLM 5.2 est-il open source ?
- Oui. Ses poids sont publiés (zai-org/GLM-5.2) : vous pouvez le télécharger et l’exécuter sur votre propre matériel, ou l’utiliser via l’un des 32 fournisseurs d’API.
- Qui a créé GLM 5.2 ?
- GLM 5.2 est développé par Z.ai (Zhipu). Il est disponible via l’API depuis le 16 juin 2026.
- GLM 5.2 est-il performant ?
- GLM 5.2 obtient un indice général de 151,8 aux tests indépendants d’Epoch AI, soit le n° 39 sur 136 modèles suivis.
- GLM 5.2 peut-il lire des images ?
- Non. GLM 5.2 n’accepte que du texte en entrée.
- Quelles sont les alternatives à GLM 5.2 ?
- Parmi les modèles d’autres entreprises à prix comparable : MiMo-V2.6-Flash, Perceptron Mk1.5 et Qwen3.8 Omni Flash. Vous pouvez les comparer côte à côte sur cette page.