Gemini 2.5 Flash
Où il se situe
La qualité aux tests indépendants face au prix, parmi 135 autres modèles. Plus haut signifie plus performant, plus à gauche moins cher.
À propos de ce modèle
Gemini 2.5 Flash est un modèle d’IA de Google DeepMind, disponible via l’API depuis le 17 juin 2025. Il peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte, et rédiger jusqu’à 65 535 tokens en une seule réponse. En plus du texte, il accepte en entrée des fichiers comme des PDF, des images, de l’audio et de la vidéo.
Via l’API, il coûte 0,30 $US par million de tokens en entrée et 2,50 $US par million de tokens en sortie. Son prix se situe dans la moyenne du marché.
Il prend en charge le raisonnement étendu : il peut « réfléchir » étape par étape avant de répondre, ce qui l’aide en mathématiques, en code et sur les questions complexes. Il peut appeler des outils et des fonctions, ce qui permet aux développeurs de le connecter à un moteur de recherche, une base de données ou d’autres logiciels.
Scores de qualité
Classements →Où l’utiliser
Entreprises qui proposent ce modèle via une API : 7. Prix par million de tokens, du moins cher au plus cher.
| Fournisseur | Entréei | Sortiei | Contextei | Disponibilité (24 h)i |
|---|---|---|---|---|
Google AI StudioOfficielLe moins cher | 0,15 $US | 1,25 $US | 1M | 100.0% |
GoogleOfficiel | 0,30 $US | 2,50 $US | 1M | 99.4% |
GoogleOfficiel | 0,30 $US | 2,50 $US | 1M | 99.7% |
Google AI StudioOfficiel | 0,30 $US | 2,50 $US | 1M | 99.9% |
GoogleOfficiel | 0,30 $US | 2,50 $US | 1M | 90.2% |
GoogleOfficiel | 0,54 $US | 4,50 $US | 1M | 100.0% |
Google AI StudioOfficiel | 0,54 $US | 4,50 $US | 1M | 97.1% |
Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.
L’utiliser dans votre code
Appelez Gemini 2.5 Flash via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "google/gemini-2.5-flash", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'import os
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key=os.environ["OPENROUTER_API_KEY"])
reply = client.chat.completions.create(
model="google/gemini-2.5-flash",
messages=[{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://openrouter.ai/api/v1", apiKey: process.env.OPENROUTER_API_KEY });
const reply = await client.chat.completions.create({
model: "google/gemini-2.5-flash",
messages: [{ role: "user", content: "Bonjour ! Que sais-tu faire ?" }],
});
console.log(reply.choices[0].message.content);Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.
Ce que ça coûte en pratique
- 1 000 réponses de chatbot0,90 $US
- Résumer un document de 100 pages0,018 $US
- Une appli à 10 000 requêtes par jour pendant un mois390 $US
Alternatives à prix similaire
| Modèle | Entréei | Sortiei | Contextei | |
|---|---|---|---|---|
Command A+Cohere | 0,30 $US | 1,50 $US | 192K | Comparer avec ⇄ |
DeepSeek V4.1 FlashDeepSeek | 0,30 $US | 1,20 $US | 1M | Comparer avec ⇄ |
LongCat 2.0Meituan | 0,30 $US | 1,20 $US | 1M | Comparer avec ⇄ |
MiniMax M3MiniMax | 0,30 $US | 1,20 $US | 1M | Comparer avec ⇄ |
Qwen3.5 Plus 2026-04-20Alibaba Qwen | 0,30 $US | 1,80 $US | 1M | Comparer avec ⇄ |
GLM 4.6VZ.ai (Zhipu) | 0,30 $US | 0,90 $US | 128K | Comparer avec ⇄ |
Actualités sur Google DeepMind
Tout voir →Questions fréquentes
- Combien coûte Gemini 2.5 Flash ?
- Via l’API, Gemini 2.5 Flash coûte 0,30 $US par million de tokens en entrée et 2,50 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 0,90 $US.
- Quelle est la fenêtre de contexte de Gemini 2.5 Flash ?
- Gemini 2.5 Flash peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte. Il peut rédiger jusqu’à 65 535 tokens en une seule réponse.
- Gemini 2.5 Flash est-il open source ?
- Non. Gemini 2.5 Flash est un modèle fermé : ses poids ne sont pas publiés, on l’utilise donc via les applications et l’API de Google DeepMind, ou via des fournisseurs cloud.
- Qui a créé Gemini 2.5 Flash ?
- Gemini 2.5 Flash est développé par Google DeepMind. Il est disponible via l’API depuis le 17 juin 2025.
- Gemini 2.5 Flash est-il performant ?
- Gemini 2.5 Flash obtient un indice général de 143,0 aux tests indépendants d’Epoch AI, soit le n° 83 sur 136 modèles suivis.
- Gemini 2.5 Flash peut-il lire des images ?
- Oui. En plus du texte, il accepte en entrée des fichiers comme des PDF, des images, de l’audio et de la vidéo.
- Quelles sont les alternatives à Gemini 2.5 Flash ?
- Parmi les modèles d’autres entreprises à prix comparable : Command A+, DeepSeek V4.1 Flash et LongCat 2.0. Vous pouvez les comparer côte à côte sur cette page.