Llama 3.2 1B Instruct

Metameta-llama/llama-3.2-1b-instructProveedores: 1
Entradai0,027 US$por millón de tokens
Salidai0,20 US$por millón de tokens
Contextoi60K60.000 tokens
Lanzamiento25 sept 2024Salida máxima: 54K

Dónde se sitúa

La calidad en pruebas independientes frente al precio, junto a otros 135 modelos. Más arriba significa más capaz; más a la izquierda, más barato.

100110120130140150160170$0.01$0.03$0.1$0.3$1$3$10$30$100Índice generalPrecio por millón de tokens, escala logarítmica (3 partes de entrada por 1 de salida)↖ Más barato y más capazLlama 3.2 1B Instruct
Puntuaciones: Epoch AI (CC BY 4.0). Precios: OpenRouter. Ver como tabla

Sobre este modelo

Llama 3.2 1B Instruct es un modelo de IA de Meta, disponible a través de la API desde el 25 de septiembre de 2024. Puede leer hasta 60.000 tokens en una sola petición, unas 113 páginas de texto, y escribir hasta 54.000 tokens en una sola respuesta.

A través de la API cuesta 0,027 US$ por millón de tokens de entrada y 0,20 US$ por millón de tokens de salida. Su precio lo sitúa entre los modelos más asequibles que seguimos, lo que lo convierte en una buena opción para tareas de gran volumen.

Sus pesos están publicados abiertamente (meta-llama/Llama-3.2-1B-Instruct), así que también se puede descargar y ejecutar en tu propio hardware.

Puntuaciones de calidad

Rankings →
102.0Índice general · N.º 136 de 136
  • GPQA DiamondPreguntas de opción múltiple muy difíciles de biología, física y química, escritas por expertos con doctorado. Responder al azar da un 25 %.23.9%N.º 115 de 116
  • Matemáticas AIMEProblemas de matemáticas de nivel de competición, al estilo del American Invitational Mathematics Examination. Porcentaje resuelto.0.6%N.º 112 de 112

Datos de benchmarks: Epoch AI, con licencia CC BY 4.0

Dónde usarlo

Empresas que ofrecen este modelo por API: 1. Precios por millón de tokens, del más barato al más caro.

ProveedorEntradaiSalidaiContextoiDisponibilidad (24 h)i
Cloudflare
0,027 US$0,20 US$60K100.0%

La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.

Úsalo en tu código

Llama a Llama 3.2 1B Instruct a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "meta-llama/llama-3.2-1b-instruct", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'

El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.

Lo que cuesta en la práctica

  • 1000 respuestas de chat
    ≈ 500 tokens de entrada y 300 de salida cada una
    0,074 US$
  • Resumir un documento de 100 páginas
    ≈ 50.000 tokens de entrada y 1000 de salida
    0,0016 US$
  • Una app con 10.000 peticiones al día durante un mes
    ≈ 1000 tokens de entrada y 400 de salida cada una
    32,22 US$

Calculadora de costos →

Alternativas de precio similar

ModeloEntradaiSalidaiContextoi
0,025 US$0,10 US$256KComparar con ⇄
Schematron V2 TurboInference Net
0,03 US$0,15 US$128KComparar con ⇄
Qwen3.7 FlashAlibaba Qwen
0,03 US$0,13 US$1MComparar con ⇄
Ling 3.0 Flash VLinclusionAI (Ant Group)
0,021 US$0,062 US$256KComparar con ⇄
0,035 US$0,14 US$128KComparar con ⇄
0,037 US$0,17 US$128KComparar con ⇄

Noticias sobre Meta

Ver todo →

Preguntas frecuentes

¿Cuánto cuesta Llama 3.2 1B Instruct?
A través de la API, Llama 3.2 1B Instruct cuesta 0,027 US$ por millón de tokens de entrada y 0,20 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 0,074 US$.
¿Cuál es la ventana de contexto de Llama 3.2 1B Instruct?
Llama 3.2 1B Instruct puede leer hasta 60.000 tokens en una sola petición, unas 113 páginas de texto. Puede escribir hasta 54.000 tokens en una sola respuesta.
¿Llama 3.2 1B Instruct es de código abierto?
Sí. Sus pesos están publicados (meta-llama/Llama-3.2-1B-Instruct), así que puedes descargarlo y ejecutarlo en tu propio hardware, o usarlo a través de uno de sus 1 proveedores de API.
¿Quién ha creado Llama 3.2 1B Instruct?
Llama 3.2 1B Instruct lo desarrolla Meta. Está disponible a través de la API desde el 25 de septiembre de 2024.
¿Qué tan bueno es Llama 3.2 1B Instruct?
Llama 3.2 1B Instruct tiene un índice general de 102,0 en las pruebas independientes de Epoch AI, el puesto n.º 136 de 136 modelos que seguimos.
¿Llama 3.2 1B Instruct puede leer imágenes?
No. Llama 3.2 1B Instruct solo acepta texto como entrada.
¿Qué alternativas hay a Llama 3.2 1B Instruct?
Entre los modelos de otras empresas con un precio parecido están Nex-N2.5-Mini, Schematron V2 Turbo y Qwen3.7 Flash. Puedes compararlos lado a lado en esta página.