Qwen3 Max Thinking

Alibaba Qwenqwen/qwen3-max-thinkingFournisseurs: 1
Entréei0,78 $USpar million de tokens
Sortiei3,90 $USpar million de tokens
Contextei256K262 144 tokens
Date de sortie9 févr. 2026Sortie max.: 64K

À propos de ce modèle

Qwen3 Max Thinking est un modèle d’IA de Alibaba Qwen, disponible via l’API depuis le 9 février 2026. Il peut lire jusqu’à 262 144 tokens en une seule requête, soit environ 492 pages de texte, et rédiger jusqu’à 65 536 tokens en une seule réponse.

Via l’API, il coûte 0,78 $US par million de tokens en entrée et 3,90 $US par million de tokens en sortie. Son prix se situe dans la moyenne du marché.

Il prend en charge le raisonnement étendu : il peut « réfléchir » étape par étape avant de répondre, ce qui l’aide en mathématiques, en code et sur les questions complexes. Il peut appeler des outils et des fonctions, ce qui permet aux développeurs de le connecter à un moteur de recherche, une base de données ou d’autres logiciels.

Scores de qualité

Classements →

Pas encore évalué. Les résultats de tests indépendants paraissent généralement quelques semaines après la sortie d’un modèle.

Données de benchmarks : Epoch AI, sous licence CC BY 4.0

Où l’utiliser

Entreprises qui proposent ce modèle via une API : 1. Prix par million de tokens, du moins cher au plus cher.

FournisseurEntréeiSortieiContexteiDisponibilité (24 h)i
AlibabaOfficiel
0,78 $US3,90 $US256K99.9%

Les disponibilités et les prix proviennent de l’API publique d’OpenRouter et sont actualisés chaque jour. La disponibilité correspond à la part de requêtes réussies sur les dernières 24 heures. Certains fournisseurs utilisent une version compressée des modèles ouverts (fp8, int4), moins chère mais parfois un peu moins précise.

L’utiliser dans votre code

Appelez Qwen3 Max Thinking via l’API d’OpenRouter, compatible avec celle d’OpenAI : créez une clé sur openrouter.ai, puis lancez l’un de ces exemples.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "qwen/qwen3-max-thinking", "messages": [{"role": "user", "content": "Bonjour ! Que sais-tu faire ?"}]}'

Le même code fonctionne avec tous les modèles de ce site : seul l’identifiant du modèle change. Beaucoup de laboratoires proposent aussi leur propre API et leur SDK.

Ce que ça coûte en pratique

  • 1 000 réponses de chatbot
    ≈ 500 tokens en entrée, 300 en sortie chacune
    1,56 $US
  • Résumer un document de 100 pages
    ≈ 50 000 tokens en entrée, 1 000 en sortie
    0,043 $US
  • Une appli à 10 000 requêtes par jour pendant un mois
    ≈ 1 000 tokens en entrée, 400 en sortie chacune
    702 $US

Calculateur de coût →

Alternatives à prix similaire

ModèleEntréeiSortieiContextei
Aion-2.0Aion Labs
0,80 $US1,60 $US128KComparer avec ⇄
Gemini 3.8 FlashGoogle DeepMind
0,75 $US3,75 $US1MComparer avec ⇄
0,75 $US4,50 $US400KComparer avec ⇄
0,74 $US2,96 $US256KComparer avec ⇄
0,83 $US2,50 $US1MComparer avec ⇄
0,66 $US1,98 $US1MComparer avec ⇄

Actualités sur Alibaba Qwen

Tout voir →

Questions fréquentes

Combien coûte Qwen3 Max Thinking ?
Via l’API, Qwen3 Max Thinking coûte 0,78 $US par million de tokens en entrée et 3,90 $US par million de tokens en sortie. Par exemple, 1 000 réponses de chat d’environ 500 tokens en entrée et 300 en sortie coûtent environ 1,56 $US.
Quelle est la fenêtre de contexte de Qwen3 Max Thinking ?
Qwen3 Max Thinking peut lire jusqu’à 262 144 tokens en une seule requête, soit environ 492 pages de texte. Il peut rédiger jusqu’à 65 536 tokens en une seule réponse.
Qwen3 Max Thinking est-il open source ?
Non. Qwen3 Max Thinking est un modèle fermé : ses poids ne sont pas publiés, on l’utilise donc via les applications et l’API de Alibaba Qwen, ou via des fournisseurs cloud.
Qui a créé Qwen3 Max Thinking ?
Qwen3 Max Thinking est développé par Alibaba Qwen. Il est disponible via l’API depuis le 9 février 2026.
Qwen3 Max Thinking peut-il lire des images ?
Non. Qwen3 Max Thinking n’accepte que du texte en entrée.
Quelles sont les alternatives à Qwen3 Max Thinking ?
Parmi les modèles d’autres entreprises à prix comparable : Aion-2.0, Gemini 3.8 Flash et GPT-5.4 Mini. Vous pouvez les comparer côte à côte sur cette page.