Gemini 2.5 Flash Lite

Google DeepMindgoogle/gemini-2.5-flash-liteProveedores: 5
Entradai0,10 US$por millón de tokens
Salidai0,40 US$por millón de tokens
Contextoi1M1.048.576 tokens
Lanzamiento22 jul 2025Salida máxima: 66K

Dónde se sitúa

La calidad en pruebas independientes frente al precio, junto a otros 135 modelos. Más arriba significa más capaz; más a la izquierda, más barato.

100110120130140150160170$0.01$0.03$0.1$0.3$1$3$10$30$100Índice generalPrecio por millón de tokens, escala logarítmica (3 partes de entrada por 1 de salida)↖ Más barato y más capazGemini 2.5 Flash Lite
Puntuaciones: Epoch AI (CC BY 4.0). Precios: OpenRouter. Ver como tabla

Sobre este modelo

Gemini 2.5 Flash Lite es un modelo de IA de Google DeepMind, disponible a través de la API desde el 22 de julio de 2025. Puede leer hasta 1.048.576 tokens en una sola petición, unas 1966 páginas de texto, y escribir hasta 65.535 tokens en una sola respuesta. Además de texto, acepta como entrada imágenes, archivos como PDF, audio y video.

A través de la API cuesta 0,10 US$ por millón de tokens de entrada y 0,40 US$ por millón de tokens de salida. Su precio lo sitúa entre los modelos más asequibles que seguimos, lo que lo convierte en una buena opción para tareas de gran volumen.

Admite razonamiento extendido: puede «pensar» paso a paso antes de responder, lo que le ayuda en matemáticas, programación y preguntas complejas. Puede llamar a herramientas y funciones, así que los desarrolladores pueden conectarlo a buscadores, bases de datos u otros programas.

Puntuaciones de calidad

Rankings →
133.9Índice general · N.º 110 de 136

Datos de benchmarks: Epoch AI, con licencia CC BY 4.0

Dónde usarlo

Empresas que ofrecen este modelo por API: 5. Precios por millón de tokens, del más barato al más caro.

ProveedorEntradaiSalidaiContextoiDisponibilidad (24 h)i
Google AI StudioOficialEl más barato
0,05 US$0,20 US$1M100.0%
GoogleOficial
0,10 US$0,40 US$1M99.9%
GoogleOficial
0,10 US$0,40 US$1M99.5%
Google AI StudioOficial
0,10 US$0,40 US$1M99.4%
Google AI StudioOficial
0,18 US$0,72 US$1M99.9%

La disponibilidad y los precios provienen de la API pública de OpenRouter y se actualizan a diario. La disponibilidad es el porcentaje de solicitudes correctas en las últimas 24 horas. Algunos proveedores ejecutan una versión comprimida de los modelos abiertos (fp8, int4), que es más barata pero puede ser algo menos precisa.

Úsalo en tu código

Llama a Gemini 2.5 Flash Lite a través de la API de OpenRouter, compatible con la de OpenAI: crea una clave en openrouter.ai y ejecuta uno de estos ejemplos.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "google/gemini-2.5-flash-lite", "messages": [{"role": "user", "content": "¡Hola! ¿Qué sabes hacer?"}]}'

El mismo código funciona con todos los modelos de este sitio: solo cambia el ID del modelo. Muchos laboratorios ofrecen también su propia API y su SDK.

Lo que cuesta en la práctica

  • 1000 respuestas de chat
    ≈ 500 tokens de entrada y 300 de salida cada una
    0,17 US$
  • Resumir un documento de 100 páginas
    ≈ 50.000 tokens de entrada y 1000 de salida
    0,0054 US$
  • Una app con 10.000 peticiones al día durante un mes
    ≈ 1000 tokens de entrada y 400 de salida cada una
    78,00 US$

Calculadora de costos →

Alternativas de precio similar

ModeloEntradaiSalidaiContextoi
0,10 US$0,50 US$1.1MComparar con ⇄
0,10 US$0,20 US$1MComparar con ⇄
0,10 US$0,10 US$16KComparar con ⇄
Qwen3.5-9BAlibaba Qwen
0,10 US$0,15 US$256KComparar con ⇄
Seed-2.0-MiniByteDance Seed
0,10 US$0,40 US$256KComparar con ⇄
0,10 US$0,30 US$256KComparar con ⇄

Noticias sobre Google DeepMind

Ver todo →

Preguntas frecuentes

¿Cuánto cuesta Gemini 2.5 Flash Lite?
A través de la API, Gemini 2.5 Flash Lite cuesta 0,10 US$ por millón de tokens de entrada y 0,40 US$ por millón de tokens de salida. Por ejemplo, 1000 respuestas de chat de unos 500 tokens de entrada y 300 de salida cuestan alrededor de 0,17 US$.
¿Cuál es la ventana de contexto de Gemini 2.5 Flash Lite?
Gemini 2.5 Flash Lite puede leer hasta 1.048.576 tokens en una sola petición, unas 1966 páginas de texto. Puede escribir hasta 65.535 tokens en una sola respuesta.
¿Gemini 2.5 Flash Lite es de código abierto?
No. Gemini 2.5 Flash Lite es un modelo cerrado: sus pesos no están publicados, así que se usa a través de las aplicaciones y la API de Google DeepMind o de proveedores en la nube.
¿Quién ha creado Gemini 2.5 Flash Lite?
Gemini 2.5 Flash Lite lo desarrolla Google DeepMind. Está disponible a través de la API desde el 22 de julio de 2025.
¿Qué tan bueno es Gemini 2.5 Flash Lite?
Gemini 2.5 Flash Lite tiene un índice general de 133,9 en las pruebas independientes de Epoch AI, el puesto n.º 110 de 136 modelos que seguimos.
¿Gemini 2.5 Flash Lite puede leer imágenes?
Sí. Además de texto, acepta como entrada imágenes, archivos como PDF, audio y video.
¿Qué alternativas hay a Gemini 2.5 Flash Lite?
Entre los modelos de otras empresas con un precio parecido están GPT-6 Luna Pro, Muse Spark 1.3 Contributor y Reka Edge. Puedes compararlos lado a lado en esta página.