Llama Guard 4 12B

Metameta-llama/llama-guard-4-12bFournisseurs: 1
Entréei0,18 $USpar million de tokens
Sortiei0,18 $USpar million de tokens
Contextei160K163 840 tokens
Date de sortie30 avr. 2025Sortie max.: 16K

À propos de ce modèle

Llama Guard 4 12B est un modèle d’IA de Meta, disponible via l’API depuis le 30 avril 2025. Il peut lire jusqu’à 163 840 tokens en une seule requête, soit environ 307 pages de texte, et rédiger jusqu’à 16 384 tokens en une seule réponse. En plus du texte, il accepte en entrée des images.

Via l’API, il coûte 0,18 $US par million de tokens en entrée et 0,18 $US par million de tokens en sortie. Son prix le place parmi les modèles les plus abordables que nous suivons, ce qui en fait un bon choix pour les gros volumes.

Ses poids sont publiés ouvertement (meta-llama/Llama-Guard-4-12B) : il peut donc aussi être téléchargé et exécuté sur votre propre matériel.

Scores de qualité

Classements →

Pas encore évalué. Les résultats de tests indépendants paraissent généralement quelques semaines après la sortie d’un modèle.

Données de benchmarks : Epoch AI, sous licence CC BY 4.0

Où l’utiliser

Entreprises qui proposent ce modèle via une API : 1. Prix par million de tokens, du moins cher au plus cher.

FournisseurEntréeiSortieiContexteiDisponibilité (24 h)i
DeepInfrabf16
0,18 $US0,18 $US160K100.0%

Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.

L’utiliser dans votre code

Appelez Llama Guard 4 12B via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "meta-llama/llama-guard-4-12b", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'

Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.

Ce que ça coûte en pratique

  • 1 000 réponses de chatbot
    ≈ 500 tokens en entrée, 300 en sortie chacune
    0,144 $US
  • Résumer un document de 100 pages
    ≈ 50 000 tokens en entrée, 1 000 en sortie
    0,0092 $US
  • Une appli à 10 000 requêtes par jour pendant un mois
    ≈ 1 000 tokens en entrée, 400 en sortie chacune
    75,60 $US

Calculateur de coût →

Alternatives à prix similaire

ModèleEntréeiSortieiContextei
0,18 $US0,60 $US256KComparer avec ⇄
0,18 $US2,10 $US128KComparer avec ⇄
0,20 $US1,20 $US1.1MComparer avec ⇄
0,20 $US0,20 $US128KComparer avec ⇄
0,20 $US1,15 $US256KComparer avec ⇄
0,20 $US0,20 $US256KComparer avec ⇄

Actualités sur Meta

Tout voir →

Questions fréquentes

Combien coûte Llama Guard 4 12B ?
Via l’API, Llama Guard 4 12B coûte 0,18 $US par million de tokens en entrée et 0,18 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 0,144 $US.
Quelle est la fenêtre de contexte de Llama Guard 4 12B ?
Llama Guard 4 12B peut lire jusqu’à 163 840 tokens en une seule requête, soit environ 307 pages de texte. Il peut rédiger jusqu’à 16 384 tokens en une seule réponse.
Llama Guard 4 12B est-il open source ?
Oui. Ses poids sont publiés (meta-llama/Llama-Guard-4-12B) : vous pouvez le télécharger et l’exécuter sur votre propre matériel, ou l’utiliser via l’un des 1 fournisseurs d’API.
Qui a créé Llama Guard 4 12B ?
Llama Guard 4 12B est développé par Meta. Il est disponible via l’API depuis le 30 avril 2025.
Llama Guard 4 12B peut-il lire des images ?
Oui. En plus du texte, il accepte en entrée des images.
Quelles sont les alternatives à Llama Guard 4 12B ?
Parmi les modèles d’autres entreprises à prix comparable : Hy3 preview, Qwen3 VL 8B Thinking et GPT-5.6 Luna Pro. Vous pouvez les comparer côte à côte sur cette page.