Logo Qwen

Qwen

Des modèles de texte, vision et temps réel dans la gamme Qwen

FreemiumChineTop Pick NXUS

Presentation

Fiche actualisée le 22 septembre 2026. Versions, accès et tarifs vérifiés dans les sources officielles citées. Cette mise à jour documentaire ne constitue pas un nouveau benchmark NXUS.

Qwen désigne la famille de modèles d’Alibaba, disponible dans Qwen Chat, dans Alibaba Cloud Model Studio et, pour certaines références, sous forme de poids à héberger. Les annonces de septembre enrichissent surtout les versions multimodales et temps réel. La région choisie dans le cloud détermine disponibilité, prix et conditions d’accès.

Les références récentes à connaître

Qwen3.8-Max-0902, publié le 2 septembre, est une version datée de la gamme Max, avec une fenêtre de contexte d’un million de tokens. Qwen3.8-Flash, annoncé fin août, est l’option multimodale économique. Le 17 septembre, le catalogue international ajoute Qwen3.8-Omni-Flash pour des entrées texte, images, audio et vidéo et des réponses textuelles. Le 21 septembre, Qwen3.8-Omni-Flash-Realtime ajoute l’interaction temps réel avec sortie texte et audio.

Sources : Nouveaux modèles Alibaba Cloud Model Studio.

Omni, Realtime et modèles locaux

Les modalités prises en charge sont aussi importantes que le nom de famille. Omni-Flash sert notamment à analyser des médias avec raisonnement et outils ; sa variante Realtime répond au besoin de conversation en continu et expose des mécanismes de connexion adaptés. Le catalogue comprend aussi des références comme Qwen3.8-27B pour les usages de vision et de déploiement. Un nom de modèle disponible dans Model Studio ne suffit pas à établir sa licence locale : vérifie le dépôt, la version et les conditions des poids que tu souhaites installer.

Sources : Nouveaux modèles Alibaba Cloud Model Studio Qwen 3.8 LiveTranslate.

Prix : préciser la région et la modalité

Dans la grille International, région de Singapour, Max et Max-0902 sont affichés à 2 $ en entrée et 6 $ en sortie par MTok, et Flash à 0,15 $ et 0,47 $. Ces prix concernent les références et tranches indiquées dans la grille, jusqu’à un million de tokens pour ces lignes. Les modèles Omni et Realtime ont leur propre facturation selon modalités ; la sortie audio ne se chiffre pas avec le seul tarif du texte. Les éventuels crédits de découverte sont soumis à région et durée : ils ne constituent pas une API gratuite à vie.

Sources : Prix des modèles par région.

Quel accès choisir ?

Pour rédiger ou découvrir les fonctions, Qwen Chat évite une intégration. Pour un assistant dans une application, Model Studio permet de choisir la référence et de suivre la consommation. Pour un déploiement local, il faut dimensionner mémoire et calcul et sélectionner un moteur compatible. Dans tous les cas, évalue les résultats en français et sur les médias réels : les tâches de transcription, traduction, vision et raisonnement n’ont pas les mêmes critères de qualité.

Où utiliser cet outil ?

Essaie Qwen Chat. Les développeurs trouveront l’accès et les modèles dans Alibaba Cloud Model Studio. La page Qwen Research permet de remonter aux annonces et dépôts officiels. Le catalogue disponible dans le chat peut différer de celui de l’API.

Sources officielles et documentation

Comment utiliser

Parcours conseillé pour une première utilisation :

  1. Commence dans Qwen Chat pour découvrir l’usage ou dans Model Studio pour une intégration.
  2. Sélectionne ta région et vérifie la disponibilité du modèle voulu avant de configurer l’application.
  3. Pour une comparaison reproductible, utilise une référence datée comme Max-0902 lorsque proposée.
  4. Choisis Omni ou Realtime seulement si la tâche nécessite les modalités correspondantes.
  5. Contrôle qualité, coût et limites sur des exemples réels, puis conserve l’identifiant exact dans ton suivi.

Pour comparer deux modèles, conserve le même document et les mêmes critères : exactitude, temps de réponse, qualité du livrable et coût réel. Une réponse plus longue ou un raisonnement plus intense ne garantissent pas un meilleur résultat.

Astuces & conseils

Fixer la région

Inclue la région cloud dans tes comparatifs de coûts et de disponibilité.

Épingler une version

Une référence datée facilite la comparaison lors d’une migration.

Fonctionnalites cles

Qwen 3.8 Max et Flash

Deux références pour besoins et budgets différents.

Omni

Analyse de plusieurs types de médias.

Realtime

Flux interactifs avec texte et audio en sortie.

Choix du déploiement

Chat, cloud ou poids locaux pour les références disponibles.

Modeles IA

Qwen3.8-Max-0902

Recommande
Contexte

1 M

Cout

International Singapour : 2 $ / 6 $ par MTok

Multimodal

Oui

Référence datée pour tâches complexes

Qwen3.8-Flash

Contexte

1 M

Cout

International Singapour : 0,15 $ / 0,47 $ par MTok

Multimodal

Oui

Usage multimodal économique

Qwen3.8-Omni-Flash

Contexte

Selon modalités et limites API

Cout

Grille Omni spécifique

Multimodal

Oui

Texte, images, audio et vidéo en entrée

Qwen3.8-Omni-Flash-Realtime

Contexte

Session temps réel

Cout

Grille Realtime spécifique

Multimodal

Oui

Interaction audio et vidéo en continu

Qwen3.8-27B

Contexte

Selon service ou moteur local

Cout

API ou coût d’infrastructure

Multimodal

Oui

Vision et déploiements adaptés au modèle

Tarifs & plans

Populaire

Qwen Chat

Gratuit selon quotas

  • Catalogue du compte

API Max International

2 $ entrée / 6 $ sortie par MTok

  • Région Singapour, grille consultée

API Flash International

0,15 $ entrée / 0,47 $ sortie par MTok

  • Région Singapour, grille consultée

Omni et Realtime

Selon modèle et modalité

  • Ne pas appliquer les prix texte à toutes les données

Poids locaux

Infrastructure à financer

  • Licence à vérifier pour chaque référence

Questions frequentes

Le catalogue international ajoute Max-0902, Omni-Flash et Omni-Flash-Realtime. Flash 3.8 est également une référence récente de la gamme.

Pas nécessairement. Le chat et l’API ont leurs catalogues, déploiements et quotas.

Non. Les montants chiffrés ici correspondent à la grille International de Singapour consultée.

La référence Omni-Flash citée produit du texte à partir de plusieurs modalités. Realtime ajoute les échanges en continu avec sortie texte et audio selon l’API.

Outils similaires

Glossaire associe

Modèle et application

Le modèle traite les données. L’application ajoute interface, fichiers, recherche et outils ; ses quotas ne sont pas nécessairement ceux de l’API.

Contexte

Quantité de tokens traitée dans une requête, avec des limites distinctes pour l’entrée et la sortie. Une fenêtre longue ne garantit pas une lecture parfaite.

MTok

Un million de tokens. Les tarifs API distinguent généralement entrée, entrée réutilisée en cache et sortie, auxquels peuvent s’ajouter des outils.

Agent

Logiciel qui utilise un modèle pour enchaîner des actions et des appels à des outils afin d’accomplir une tâche.

3/5
MAJ : 22 septembre 2026
Fonde en 2023
2 258 vues

Ressources connexes