Hermes 3 405B Instruct

Nous Researchnousresearch/hermes-3-llama-3.1-405bProveedores: 1
Entradai1 US$por millón de tokens
Salidai1 US$por millón de tokens
Contextoi128K131.072 tokens
Lanzamiento16 ago 2024Salida máxima: 16K

Sobre este modelo

Hermes 3 405B Instruct es un modelo de IA de Nous Research, disponible a través de la API desde el 16 de agosto de 2024. Puede leer hasta 131.072 tokens en una sola petición, unas 246 páginas de texto, y escribir hasta 16.384 tokens en una sola respuesta.

A través de la API cuesta 1 US$ por millón de tokens de entrada y 1 US$ por millón de tokens de salida. Su precio está en la media del mercado.

Sus pesos están publicados abiertamente (NousResearch/Hermes-3-Llama-3.1-405B), así que también se puede descargar y ejecutar en tu propio hardware.

Puntuaciones de calidad

Rankings →

Aún sin evaluar. Los resultados de pruebas independientes suelen aparecer unas semanas después del lanzamiento de un modelo.

Datos de benchmarks: Epoch AI, con licencia CC BY 4.0

Dónde usarlo

Empresas que ofrecen este modelo por API: 1. Precios por millón de tokens, del más barato al más caro.

ProveedorEntradaiSalidaiContextoiDisponibilidad (24 h)i
DeepInfrafp8
1 US$1 US$128K100.0%

La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.

Úsalo en tu código

Llama a Hermes 3 405B Instruct a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "nousresearch/hermes-3-llama-3.1-405b", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'

El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.

Lo que cuesta en la práctica

  • 1000 respuestas de chat
    ≈ 500 tokens de entrada y 300 de salida cada una
    0,80 US$
  • Resumir un documento de 100 páginas
    ≈ 50.000 tokens de entrada y 1000 de salida
    0,051 US$
  • Una app con 10.000 peticiones al día durante un mes
    ≈ 1000 tokens de entrada y 400 de salida cada una
    420 US$

Calculadora de costos →

Alternativas de precio similar

ModeloEntradaiSalidaiContextoi
InklingThinking Machines Lab
1 US$4,05 US$512KComparar con ⇄
1 US$2 US$256KComparar con ⇄
1 US$3 US$256KComparar con ⇄
1 US$5 US$200KComparar con ⇄
SonarPerplexity
1 US$1 US$127KComparar con ⇄
1,03 US$6,16 US$256KComparar con ⇄

Preguntas frecuentes

¿Cuánto cuesta Hermes 3 405B Instruct?
A través de la API, Hermes 3 405B Instruct cuesta 1 US$ por millón de tokens de entrada y 1 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 0,80 US$.
¿Cuál es la ventana de contexto de Hermes 3 405B Instruct?
Hermes 3 405B Instruct puede leer hasta 131.072 tokens en una sola petición, unas 246 páginas de texto. Puede escribir hasta 16.384 tokens en una sola respuesta.
¿Hermes 3 405B Instruct es de código abierto?
Sí. Sus pesos están publicados (NousResearch/Hermes-3-Llama-3.1-405B), así que puedes descargarlo y ejecutarlo en tu propio hardware, o usarlo a través de uno de sus 1 proveedores de API.
¿Quién ha creado Hermes 3 405B Instruct?
Hermes 3 405B Instruct lo desarrolla Nous Research. Está disponible a través de la API desde el 16 de agosto de 2024.
¿Hermes 3 405B Instruct puede leer imágenes?
No. Hermes 3 405B Instruct solo acepta texto como entrada.
¿Qué alternativas hay a Hermes 3 405B Instruct?
Entre los modelos de otras empresas con un precio parecido están Inkling, Grok Build 0.1 y Relace Search. Puedes compararlos lado a lado en esta página.