Hermes 4 405B

Nous Researchnousresearch/hermes-4-405bFournisseurs: 1
Entréei1 $USpar million de tokens
Sortiei3 $USpar million de tokens
Contextei128K131 072 tokens
Date de sortie26 août 2025Sortie max.: 118K

À propos de ce modèle

Hermes 4 405B est un modèle d’IA de Nous Research, disponible via l’API depuis le 26 août 2025. Il peut lire jusqu’à 131 072 tokens en une seule requête, soit environ 246 pages de texte, et rédiger jusqu’à 117 964 tokens en une seule réponse.

Via l’API, il coûte 1 $US par million de tokens en entrée et 3 $US par million de tokens en sortie. Son prix se situe dans la moyenne du marché.

Il prend en charge le raisonnement étendu : il peut « réfléchir » étape par étape avant de répondre, ce qui l’aide en mathématiques, en code et sur les questions complexes. Ses poids sont publiés ouvertement (NousResearch/Hermes-4-405B) : il peut donc aussi être téléchargé et exécuté sur votre propre matériel.

Scores de qualité

Classements →

Pas encore évalué. Les résultats de tests indépendants paraissent généralement quelques semaines après la sortie d’un modèle.

Données de benchmarks : Epoch AI, sous licence CC BY 4.0

Où l’utiliser

Entreprises qui proposent ce modèle via une API : 1. Prix par million de tokens, du moins cher au plus cher.

FournisseurEntréeiSortieiContexteiDisponibilité (24 h)i
Nebiusfp8
1 $US3 $US128K100.0%

Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.

L’utiliser dans votre code

Appelez Hermes 4 405B via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "nousresearch/hermes-4-405b", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'

Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.

Ce que ça coûte en pratique

  • 1 000 réponses de chatbot
    ≈ 500 tokens en entrée, 300 en sortie chacune
    1,40 $US
  • Résumer un document de 100 pages
    ≈ 50 000 tokens en entrée, 1 000 en sortie
    0,053 $US
  • Une appli à 10 000 requêtes par jour pendant un mois
    ≈ 1 000 tokens en entrée, 400 en sortie chacune
    660 $US

Calculateur de coût →

Alternatives à prix similaire

ModèleEntréeiSortieiContextei
InklingThinking Machines Lab
1 $US4,05 $US512KComparer avec ⇄
1 $US2 $US256KComparer avec ⇄
1 $US3 $US256KComparer avec ⇄
1 $US5 $US200KComparer avec ⇄
1,03 $US6,16 $US256KComparer avec ⇄
0,96 $US1,91 $US1MComparer avec ⇄

Questions fréquentes

Combien coûte Hermes 4 405B ?
Via l’API, Hermes 4 405B coûte 1 $US par million de tokens en entrée et 3 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 1,40 $US.
Quelle est la fenêtre de contexte de Hermes 4 405B ?
Hermes 4 405B peut lire jusqu’à 131 072 tokens en une seule requête, soit environ 246 pages de texte. Il peut rédiger jusqu’à 117 964 tokens en une seule réponse.
Hermes 4 405B est-il open source ?
Oui. Ses poids sont publiés (NousResearch/Hermes-4-405B) : vous pouvez le télécharger et l’exécuter sur votre propre matériel, ou l’utiliser via l’un des 1 fournisseurs d’API.
Qui a créé Hermes 4 405B ?
Hermes 4 405B est développé par Nous Research. Il est disponible via l’API depuis le 26 août 2025.
Hermes 4 405B peut-il lire des images ?
Non. Hermes 4 405B n’accepte que du texte en entrée.
Quelles sont les alternatives à Hermes 4 405B ?
Parmi les modèles d’autres entreprises à prix comparable : Inkling, Grok Build 0.1 et Relace Search. Vous pouvez les comparer côte à côte sur cette page.