DeepSeek V4.1 Flash

DeepSeekdeepseek/deepseek-v4.1-flashFournisseurs: 33
Entréei0,30 $USpar million de tokens
Sortiei1,20 $USpar million de tokens
Contextei1M1 048 576 tokens
Date de sortie10 sept. 2026Sortie max.: 944K

Où il se situe

La qualité aux tests indépendants face au prix, parmi 135 autres modèles. Plus haut signifie plus performant, plus à gauche moins cher.

100110120130140150160170$0.01$0.03$0.1$0.3$1$3$10$30$100Indice généralPrix par million de tokens, échelle logarithmique (3 parts d’entrée pour 1 part de sortie)↖ Moins cher et plus performantDeepSeek V4.1 Flash
Scores : Epoch AI (CC BY 4.0). Prix : OpenRouter. Voir sous forme de tableau

À propos de ce modèle

DeepSeek V4.1 Flash est un modèle d’IA de DeepSeek, disponible via l’API depuis le 10 septembre 2026. Il peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte, et rédiger jusqu’à 943 718 tokens en une seule réponse. En plus du texte, il accepte en entrée des images.

Via l’API, il coûte 0,30 $US par million de tokens en entrée et 1,20 $US par million de tokens en sortie. Son prix se situe dans la moyenne du marché.

Il prend en charge le raisonnement étendu : il peut « réfléchir » étape par étape avant de répondre, ce qui l’aide en mathématiques, en code et sur les questions complexes. Il peut appeler des outils et des fonctions, ce qui permet aux développeurs de le connecter à un moteur de recherche, une base de données ou d’autres logiciels. Ses poids sont publiés ouvertement (deepseek-ai/DeepSeek-V4.1-Flash) : il peut donc aussi être téléchargé et exécuté sur votre propre matériel.

Scores de qualité

Classements →
155.0Indice général · n°27 sur 136

Données de benchmarks : Epoch AI, sous licence CC BY 4.0

Où l’utiliser

Entreprises qui proposent ce modèle via une API : 33. Prix par million de tokens, du moins cher au plus cher.

FournisseurEntréeiSortieiContexteiDisponibilité (24 h)i
Sail ResearchLe moins cherfp4
0,08 $US0,40 $US1M95.3%
InferenceNet
0,069 $US0,45 $US1M98.8%
Wafer
0,08 $US0,44 $US1M99.8%
DekaLLM
0,12 $US0,40 $US1M97.1%
OpenInferencefp4
0,03 $US0,50 $US1M99.1%
DeepInfrafp8
0,14 $US0,42 $US1M99.9%
AtlasCloudfp8
0,11 $US0,46 $US1M99.9%
Morphfp8
0,081 $US0,51 $US1M96.4%

Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.

L’utiliser dans votre code

Appelez DeepSeek V4.1 Flash via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek/deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'

Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.

Ce que ça coûte en pratique

  • 1 000 réponses de chatbot
    ≈ 500 tokens en entrée, 300 en sortie chacune
    0,51 $US
  • Résumer un document de 100 pages
    ≈ 50 000 tokens en entrée, 1 000 en sortie
    0,016 $US
  • Une appli à 10 000 requêtes par jour pendant un mois
    ≈ 1 000 tokens en entrée, 400 en sortie chacune
    234 $US

Calculateur de coût →

Alternatives à prix similaire

ModèleEntréeiSortieiContextei
0,30 $US1,50 $US192KComparer avec ⇄
GLM 5.3 FlashXZ.ai (Zhipu)
0,37 $US1,25 $US1MComparer avec ⇄
Gemini 3.5 Flash LiteGoogle DeepMind
0,30 $US2,50 $US1MComparer avec ⇄
0,30 $US1,20 $US1MComparer avec ⇄
MiniMax M3MiniMax
0,30 $US1,20 $US1MComparer avec ⇄
0,30 $US1,80 $US1MComparer avec ⇄

Actualités sur DeepSeek

Tout voir →

Questions fréquentes

Combien coûte DeepSeek V4.1 Flash ?
Via l’API, DeepSeek V4.1 Flash coûte 0,30 $US par million de tokens en entrée et 1,20 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 0,51 $US.
Quelle est la fenêtre de contexte de DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash peut lire jusqu’à 1 048 576 tokens en une seule requête, soit environ 1 966 pages de texte. Il peut rédiger jusqu’à 943 718 tokens en une seule réponse.
DeepSeek V4.1 Flash est-il open source ?
Oui. Ses poids sont publiés (deepseek-ai/DeepSeek-V4.1-Flash) : vous pouvez le télécharger et l’exécuter sur votre propre matériel, ou l’utiliser via l’un des 33 fournisseurs d’API.
Qui a créé DeepSeek V4.1 Flash ?
DeepSeek V4.1 Flash est développé par DeepSeek. Il est disponible via l’API depuis le 10 septembre 2026.
DeepSeek V4.1 Flash est-il performant ?
DeepSeek V4.1 Flash obtient un indice général de 155,0 aux tests indépendants d’Epoch AI, soit le n° 27 sur 136 modèles suivis.
DeepSeek V4.1 Flash peut-il lire des images ?
Oui. En plus du texte, il accepte en entrée des images.
Quelles sont les alternatives à DeepSeek V4.1 Flash ?
Parmi les modèles d’autres entreprises à prix comparable : Command A+, GLM 5.3 FlashX et Gemini 3.5 Flash Lite. Vous pouvez les comparer côte à côte sur cette page.