WizardLM-2 8x22B

Microsoftmicrosoft/wizardlm-2-8x22bFournisseurs: 1
Entréei0,62 $USpar million de tokens
Sortiei0,62 $USpar million de tokens
Contextei66K65 535 tokens
Date de sortie16 avr. 2024Sortie max.: 8K

À propos de ce modèle

WizardLM-2 8x22B est un modèle d’IA de Microsoft, disponible via l’API depuis le 16 avril 2024. Il peut lire jusqu’à 65 535 tokens en une seule requête, soit environ 123 pages de texte, et rédiger jusqu’à 8 000 tokens en une seule réponse.

Via l’API, il coûte 0,62 $US par million de tokens en entrée et 0,62 $US par million de tokens en sortie. Son prix le place parmi les modèles les plus abordables que nous suivons, ce qui en fait un bon choix pour les gros volumes.

Ses poids sont publiés ouvertement (microsoft/WizardLM-2-8x22B) : il peut donc aussi être téléchargé et exécuté sur votre propre matériel.

Scores de qualité

Classements →
  • GPQA DiamondQuestions à choix multiples très difficiles en biologie, physique et chimie, rédigées par des docteurs. Répondre au hasard donne 25 %.43.4%n°104 sur 116

Données de benchmarks : Epoch AI, sous licence CC BY 4.0

Où l’utiliser

Entreprises qui proposent ce modèle via une API : 1. Prix par million de tokens, du moins cher au plus cher.

FournisseurEntréeiSortieiContexteiDisponibilité (24 h)i
Novitabf16
0,62 $US0,62 $US66K100.0%

Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.

L’utiliser dans votre code

Appelez WizardLM-2 8x22B via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "microsoft/wizardlm-2-8x22b", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'

Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.

Ce que ça coûte en pratique

  • 1 000 réponses de chatbot
    ≈ 500 tokens en entrée, 300 en sortie chacune
    0,496 $US
  • Résumer un document de 100 pages
    ≈ 50 000 tokens en entrée, 1 000 en sortie
    0,032 $US
  • Une appli à 10 000 requêtes par jour pendant un mois
    ≈ 1 000 tokens en entrée, 400 en sortie chacune
    260 $US

Calculateur de coût →

Alternatives à prix similaire

ModèleEntréeiSortieiContextei
0,60 $US2,40 $US256KComparer avec ⇄
GLM 5Z.ai (Zhipu)
0,60 $US1,92 $US200KComparer avec ⇄
0,60 $US6 $US1MComparer avec ⇄
Kimi K2 ThinkingMoonshot AI
0,60 $US2,50 $US256KComparer avec ⇄
Qwen3 Coder PlusAlibaba Qwen
0,65 $US3,25 $US1MComparer avec ⇄
Gemma 2 27BGoogle DeepMind
0,65 $US0,65 $US8KComparer avec ⇄

Actualités sur Microsoft

Tout voir →

Questions fréquentes

Combien coûte WizardLM-2 8x22B ?
Via l’API, WizardLM-2 8x22B coûte 0,62 $US par million de tokens en entrée et 0,62 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 0,496 $US.
Quelle est la fenêtre de contexte de WizardLM-2 8x22B ?
WizardLM-2 8x22B peut lire jusqu’à 65 535 tokens en une seule requête, soit environ 123 pages de texte. Il peut rédiger jusqu’à 8 000 tokens en une seule réponse.
WizardLM-2 8x22B est-il open source ?
Oui. Ses poids sont publiés (microsoft/WizardLM-2-8x22B) : vous pouvez le télécharger et l’exécuter sur votre propre matériel, ou l’utiliser via l’un des 1 fournisseurs d’API.
Qui a créé WizardLM-2 8x22B ?
WizardLM-2 8x22B est développé par Microsoft. Il est disponible via l’API depuis le 16 avril 2024.
WizardLM-2 8x22B peut-il lire des images ?
Non. WizardLM-2 8x22B n’accepte que du texte en entrée.
Quelles sont les alternatives à WizardLM-2 8x22B ?
Parmi les modèles d’autres entreprises à prix comparable : Nemotron 3 Ultra, GLM 5 et Palmyra X5. Vous pouvez les comparer côte à côte sur cette page.