
Qwen
Des modèles de texte, vision et temps réel dans la gamme Qwen
Presentation
Fiche actualisée le 22 septembre 2026. Versions, accès et tarifs vérifiés dans les sources officielles citées. Cette mise à jour documentaire ne constitue pas un nouveau benchmark NXUS.
Qwen désigne la famille de modèles d’Alibaba, disponible dans Qwen Chat, dans Alibaba Cloud Model Studio et, pour certaines références, sous forme de poids à héberger. Les annonces de septembre enrichissent surtout les versions multimodales et temps réel. La région choisie dans le cloud détermine disponibilité, prix et conditions d’accès.
Les références récentes à connaître
Qwen3.8-Max-0902, publié le 2 septembre, est une version datée de la gamme Max, avec une fenêtre de contexte d’un million de tokens. Qwen3.8-Flash, annoncé fin août, est l’option multimodale économique. Le 17 septembre, le catalogue international ajoute Qwen3.8-Omni-Flash pour des entrées texte, images, audio et vidéo et des réponses textuelles. Le 21 septembre, Qwen3.8-Omni-Flash-Realtime ajoute l’interaction temps réel avec sortie texte et audio.
Sources : Nouveaux modèles Alibaba Cloud Model Studio.
Omni, Realtime et modèles locaux
Les modalités prises en charge sont aussi importantes que le nom de famille. Omni-Flash sert notamment à analyser des médias avec raisonnement et outils ; sa variante Realtime répond au besoin de conversation en continu et expose des mécanismes de connexion adaptés. Le catalogue comprend aussi des références comme Qwen3.8-27B pour les usages de vision et de déploiement. Un nom de modèle disponible dans Model Studio ne suffit pas à établir sa licence locale : vérifie le dépôt, la version et les conditions des poids que tu souhaites installer.
Sources : Nouveaux modèles Alibaba Cloud Model Studio Qwen 3.8 LiveTranslate.
Prix : préciser la région et la modalité
Dans la grille International, région de Singapour, Max et Max-0902 sont affichés à 2 $ en entrée et 6 $ en sortie par MTok, et Flash à 0,15 $ et 0,47 $. Ces prix concernent les références et tranches indiquées dans la grille, jusqu’à un million de tokens pour ces lignes. Les modèles Omni et Realtime ont leur propre facturation selon modalités ; la sortie audio ne se chiffre pas avec le seul tarif du texte. Les éventuels crédits de découverte sont soumis à région et durée : ils ne constituent pas une API gratuite à vie.
Sources : Prix des modèles par région.
Quel accès choisir ?
Pour rédiger ou découvrir les fonctions, Qwen Chat évite une intégration. Pour un assistant dans une application, Model Studio permet de choisir la référence et de suivre la consommation. Pour un déploiement local, il faut dimensionner mémoire et calcul et sélectionner un moteur compatible. Dans tous les cas, évalue les résultats en français et sur les médias réels : les tâches de transcription, traduction, vision et raisonnement n’ont pas les mêmes critères de qualité.
Où utiliser cet outil ?
Essaie Qwen Chat. Les développeurs trouveront l’accès et les modèles dans Alibaba Cloud Model Studio. La page Qwen Research permet de remonter aux annonces et dépôts officiels. Le catalogue disponible dans le chat peut différer de celui de l’API.
Sources officielles et documentation
Comment utiliser
Parcours conseillé pour une première utilisation :
- Commence dans Qwen Chat pour découvrir l’usage ou dans Model Studio pour une intégration.
- Sélectionne ta région et vérifie la disponibilité du modèle voulu avant de configurer l’application.
- Pour une comparaison reproductible, utilise une référence datée comme Max-0902 lorsque proposée.
- Choisis Omni ou Realtime seulement si la tâche nécessite les modalités correspondantes.
- Contrôle qualité, coût et limites sur des exemples réels, puis conserve l’identifiant exact dans ton suivi.
Pour comparer deux modèles, conserve le même document et les mêmes critères : exactitude, temps de réponse, qualité du livrable et coût réel. Une réponse plus longue ou un raisonnement plus intense ne garantissent pas un meilleur résultat.
Astuces & conseils
Fixer la région
Inclue la région cloud dans tes comparatifs de coûts et de disponibilité.
Épingler une version
Une référence datée facilite la comparaison lors d’une migration.
Fonctionnalites cles
Qwen 3.8 Max et Flash
Deux références pour besoins et budgets différents.
Omni
Analyse de plusieurs types de médias.
Realtime
Flux interactifs avec texte et audio en sortie.
Choix du déploiement
Chat, cloud ou poids locaux pour les références disponibles.
Modeles IA
Qwen3.8-Max-0902
Recommande1 M
International Singapour : 2 $ / 6 $ par MTok
Oui
Référence datée pour tâches complexes
Qwen3.8-Flash
1 M
International Singapour : 0,15 $ / 0,47 $ par MTok
Oui
Usage multimodal économique
Qwen3.8-Omni-Flash
Selon modalités et limites API
Grille Omni spécifique
Oui
Texte, images, audio et vidéo en entrée
Qwen3.8-Omni-Flash-Realtime
Session temps réel
Grille Realtime spécifique
Oui
Interaction audio et vidéo en continu
Qwen3.8-27B
Selon service ou moteur local
API ou coût d’infrastructure
Oui
Vision et déploiements adaptés au modèle
Tarifs & plans
Qwen Chat
Gratuit selon quotas
- Catalogue du compte
API Max International
2 $ entrée / 6 $ sortie par MTok
- Région Singapour, grille consultée
API Flash International
0,15 $ entrée / 0,47 $ sortie par MTok
- Région Singapour, grille consultée
Omni et Realtime
Selon modèle et modalité
- Ne pas appliquer les prix texte à toutes les données
Poids locaux
Infrastructure à financer
- Licence à vérifier pour chaque référence
Questions frequentes
Le catalogue international ajoute Max-0902, Omni-Flash et Omni-Flash-Realtime. Flash 3.8 est également une référence récente de la gamme.
Pas nécessairement. Le chat et l’API ont leurs catalogues, déploiements et quotas.
Non. Les montants chiffrés ici correspondent à la grille International de Singapour consultée.
La référence Omni-Flash citée produit du texte à partir de plusieurs modalités. Realtime ajoute les échanges en continu avec sortie texte et audio selon l’API.
Outils similaires
Glossaire associe
Modèle et application
Le modèle traite les données. L’application ajoute interface, fichiers, recherche et outils ; ses quotas ne sont pas nécessairement ceux de l’API.
Contexte
Quantité de tokens traitée dans une requête, avec des limites distinctes pour l’entrée et la sortie. Une fenêtre longue ne garantit pas une lecture parfaite.
MTok
Un million de tokens. Les tarifs API distinguent généralement entrée, entrée réutilisée en cache et sortie, auxquels peuvent s’ajouter des outils.
Agent
Logiciel qui utilise un modèle pour enchaîner des actions et des appels à des outils afin d’accomplir une tâche.
Ressources connexes
Prompts ChatGPT
+500 prompts IA gratuits classés en 21 catégories
Agent IA : le guide
C'est quoi un agent IA ? Définition, exemples et comment démarrer
Cas d'usage agents IA
+800 scénarios concrets par métier et par agent (Claude Code, Codex…)
Skills IA
Compétences à brancher sur Claude, Codex et tes agents
Blog IA
Actualités, tutoriels et analyses sur l'intelligence artificielle
Passer à l’IA
Agent IA, formation des équipes et conduite du changement