Qwen
GRATUITLa famille de modèles ouverts d'Alibaba : des poids téléchargeables, de 0,8 à 2 400 milliards de paramètres, et un assistant gratuit, Qwen Studio.
Note de la rédaction, basée sur l'analyse des avis utilisateurs et de la documentation disponible.

À quoi sert Qwen ?
Qwen (通义千问, Tongyi Qianwen) n'est pas un produit mais une famille de modèles d'IA, celle d'Alibaba. On y accède de trois manières très différentes, et c'est justement ce qui fait son intérêt : par Qwen Studio, l'assistant grand public gratuit (l'ancien « Qwen Chat », rebaptisé depuis) ; par l'API d'Alibaba Cloud Model Studio ; ou en téléchargeant les poids pour les exécuter sur sa propre machine, avec Ollama, llama.cpp ou vLLM.
C'est ce troisième chemin qui le distingue vraiment. Là où ChatGPT ne s'utilise que chez son éditeur, Alibaba publie ses poids, sous licence Apache 2.0 pour la gamme classique, sans clause de repartage ni seuil d'utilisateurs. Et la gamme est vertigineuse : plus de 450 modèles publiés sur Hugging Face, du modèle de 0,8 milliard de paramètres qui tient sur un portable aux 2 400 milliards de Qwen3.8-Max, plus des déclinaisons code, vision, transcription, synthèse vocale et image. Aucune autre famille n'est aussi déclinée, d'où son statut de choix par défaut chez qui fait tourner un modèle chez soi ou chez un hébergeur européen.

Où en est la famille Qwen en 2026 ?
Attention au piège de version : la génération ouverte et la génération commerciale ne portent pas les mêmes numéros. Côté poids ouverts, la dernière en date est Qwen3.8-Flash-Next, sortie le 26 août 2026 : 125 milliards de paramètres dont 6 actifs, plus 51 milliards de N-gram, présentée comme l'antichambre de l'architecture Qwen4, sous Qwen Community License 1.0. Elle suit Qwen3.8-27B, un dense publié en août sous licence Apache 2.0, et les poids de Qwen3.8-Max, 2 400 milliards de paramètres dont 95 actifs, en ligne depuis le 9 août sous licence maison. Côté API, le vaisseau amiral est Qwen3.8-Max, aux côtés de Qwen3.7 Max, Qwen3.7 Plus et Qwen3.7 Flash, et la version de production du modèle Flash, Qwen3.8-Flash, est désormais servie à 0,15 $ le million de tokens en entrée et 0,47 $ en sortie (relevé du 31 août 2026). Le détail est dans notre analyse de Qwen3.8-Max et notre analyse de Qwen3.8-Flash.
Artificial Analysis désignait le 30 avril 2026 Qwen3.6-27B comme « le nouveau leader des modèles à poids ouverts sous 150 milliards de paramètres », à 46 points sur son Intelligence Index, avec une réserve : il consomme environ 3,7 fois plus de tokens de sortie que Gemma 4 31B pour passer le même indice. Le propriétaire Qwen3.7 Max, lui, atteignait 56,6 points le 21 mai 2026 : « au plus près de la frontière », sans rejoindre OpenAI, Anthropic ni Google.
Les 46 et 56,6 points ci-dessus ont été mesurés sur une version antérieure de l'Intelligence Index. Artificial Analysis en est à la v4.1.1 depuis début août 2026, avec neuf épreuves et une pondération révisée : sur ce barème, au relevé du 7 août 2026, Qwen3.7 Max obtient 46,7 et Qwen3.8-Max 58,1. Comparer un score de mai à un score d'août revient à comparer deux règles différentes. Réclamez toujours la version de l'indice avec le chiffre.
Qwen est-il gratuit ?
Oui : Qwen Studio est gratuit, en web comme en application mobile, et l'éditeur ne publie à ce jour aucune offre d'abonnement grand public (la seule offre par abonnement vise les développeurs : un Coding Plan à 50 $ par mois, relevé le 31 août 2026, détaillé dans notre comparatif Qwen contre GLM et confronté à Google dans notre comparatif Gemini contre Qwen). L'interface est traduite en français et donne accès au chat, à la génération et à l'édition d'images, à la lecture de documents et au mode vocal.

Les développeurs, eux, paient à l'usage sur Alibaba Cloud Model Studio. Voici les tarifs publics de la région internationale (Singapour), au million de tokens :
| Modèle (API) | Entrée | Sortie | Poids |
|---|---|---|---|
| qwen3.8-max | 2,00 $ | 6,00 $ | Ouverts depuis le 9 août, licence maison |
| qwen3.8-flash | 0,15 $ | 0,47 $ | API ouverte ; poids ouverts (Flash-Next), licence maison |
| qwen3.7-max | 2,50 $ | 7,50 $ | Propriétaire |
| qwen3.7-plus | 0,40 $ | 1,60 $ | Propriétaire |
| qwen3.7-flash | 0,03 $ | 0,13 $ | Propriétaire |
| qwen3.6-flash | 0,25 $ | 1,50 $ | Ouverts (Qwen3.6-35B-A3B) |
| qwen3.5-flash | 0,10 $ | 0,40 $ | Ouverts |
Les quatre premières lignes ont été relevées le 7 août 2026 sur la documentation QwenCloud et sur la fiche officielle qwen3.8-max (déploiement international, hors promotions et hors remises de cache). La ligne qwen3.8-flash a été re-relevée le 31 août 2026 sur Model Studio : l'API de la version production est ouverte (l'annonce du 26 août 2026 affichait 0,16 $ en entrée, la grille en sert 0,15 $). Le tarif de qwen3.7-flash vaut jusqu'à 32 000 tokens en entrée par requête, celui de qwen3.7-plus jusqu'à 256 000 ; au-delà, ils augmentent. Sur qwen3.8-max, le cache implicite est facturé 0,25 $ en entrée. Les lignes qwen3.6-flash et qwen3.5-flash datent du relevé du 27 juillet 2026 et ne figurent plus sur la page de tarifs actuelle. Chaque nouveau compte reçoit un quota gratuit, valable 90 jours, mais les fiches modèles qwen3.8-max et qwen3.8-flash affichent « Free Quota : Not Supported » au relevé du 3 septembre 2026 : ce quota de bienvenue ne couvre pas ces deux modèles.
Ce qu'en disent les utilisateurs
Sur r/LocalLLaMA, le fil consacré à la sortie de Qwen3.6 raconte une session de programmation autonome menée sur une simple RTX 4090, avec la variante 35B-A3B :
Je lui ai donné pour tâche de construire un jeu de tower defense (…). Mon Dieu, il le fait vraiment. Il teste maintenant la fonction d'amélioration, il a remarqué à un moment que le canevas ne s'affichait pas, l'a vu et l'a corrigé. Il a repéré son propre bug dans la validation des vagues et il est en train de le régler… Je suis bluffé.u/Local-Cardiologist-5, r/LocalLLaMA, 17 avril 2026 · traduit de l'anglais
Les mêmes fils rappellent que « petit » ne veut pas dire « équivalent » : u/NNN_Throwaway2 notait le 23 avril 2026 que le modèle de 397 milliards de paramètres « avait bien plus de connaissances du monde et une bien meilleure cohérence logique sur les contextes longs et les tâches complexes », des dimensions « que les benchmarks actuels ne capturent pas vraiment ».
Où vont vos données avec Qwen ?
C'est le point de vigilance, et il mérite d'être dit précisément. L'assistant est édité par Alibaba Cloud (Singapore) Private Limited. Sa politique de confidentialité (mise à jour le 19 mai 2026) indique noir sur blanc que les données personnelles sont stockées ou traitées « à Singapour et en Chine continentale », avec un accès distant encadré depuis ces deux pays. Elle précise aussi que les contenus utilisateurs dé-identifiés et les retours servent à « entraîner et améliorer » les services, modèles d'IA compris, au titre de l'intérêt légitime.
Pour un dossier client, un contrat ou des données personnelles, l'application hébergée n'est pas le bon véhicule : une entreprise chinoise reste soumise à la législation locale. L'atout de Qwen, ici, c'est qu'il offre une porte de sortie que peu d'assistants proposent : les poids ouverts s'auto-hébergent, et la donnée ne quitte alors jamais votre infrastructure. Alibaba applique par ailleurs à ses propres salariés une prudence symétrique vis-à-vis des outils américains, comme le montre son bannissement de Claude Code.
Qwen, DeepSeek ou Mistral ?
Face aux autres modèles ouverts chinois, Qwen se distingue moins par la puissance brute que par l'étendue de la gamme et la clarté de sa licence : DeepSeek reste la référence du rapport qualité/prix en API, Kimi joue le contexte long et les très gros modèles. Voir notre suivi de la publication des poids de Kimi K3. Pour des serveurs européens, le comparable direct est Le Chat de Mistral ; les trois figurent dans notre catégorie Chatbots & agents.
Questions fréquentes
Qwen est-il gratuit ?
Oui. L'assistant Qwen Studio est gratuit sur le web et en application mobile, sans abonnement payant publié à ce jour, et les poids des modèles ouverts se téléchargent librement. Seule l'API d'Alibaba Cloud Model Studio est facturée à l'usage, à partir de 0,03 $ par million de tokens en entrée sur qwen3.7-flash, tarif relevé le 7 août 2026.
C'est quoi Qwen ?
La famille de modèles d'intelligence artificielle d'Alibaba (Tongyi Qianwen en chinois) : plus de 450 modèles publiés, du texte au code, à la vision, à l'audio et à l'image, accessibles via l'assistant Qwen Studio, une API, ou en téléchargement.
Qu'est-ce que Qwen3.8-Max ?
Le modèle le plus puissant de la famille, publié le 3 août 2026 : 2 400 milliards de paramètres dont 95 activés par token, appelable par API à 2 $ le million de tokens en entrée. Alibaba annonce l'ouverture de ses poids, une première pour la gamme Max. Détails dans notre analyse de Qwen3.8-Max et notre comparatif Qwen contre DeepSeek.
Qwen est-il open source ?
Ses poids sont publiés sous licence Apache 2.0 pour la gamme classique, ce qui autorise l'usage commercial, la modification et la redistribution. Les modèles récents de classe Max et Flash sont sous licences maison : Qwen3.8-Max License et Qwen Community License 1.0, qui exigent un accord séparé pour l'hébergement commercial. On parle plutôt de « poids ouverts » que d'open source : les données et le code d'entraînement ne sont pas publiés.
Qwen parle-t-il français ?
L'interface de Qwen Studio est entièrement traduite en français et Alibaba annonce 201 langues et dialectes pris en charge depuis Qwen3.5. La qualité rédactionnelle en français reste toutefois peu évaluée par des sources indépendantes : à éprouver sur vos propres cas.
Peut-on installer Qwen sur son ordinateur ?
Oui, c'est même son principal atout. Les modèles ouverts vont de 0,8 à 2 400 milliards de paramètres et s'installent en une commande via Ollama, llama.cpp ou vLLM ; les petites tailles tournent sur un portable récent, les grandes demandent du matériel de serveur.
Qwen est-il sûr pour des données professionnelles ?
Dans sa version hébergée, à manier avec précaution : la politique de confidentialité indique un stockage à Singapour et en Chine continentale et une réutilisation des contenus dé-identifiés pour l'entraînement. Pour des données sensibles, préférez l'auto-hébergement des poids ouverts.
Points forts & limites
Pour un dossier confidentiel, ne passez pas par l'application : téléchargez les poids (Apache 2.0) et faites-les tourner en local ou chez un hébergeur européen. C'est le seul moyen d'être certain que vos contenus ne quittent pas votre infrastructure.
Cas d'usage typiques
Alternatives à Qwen
Trois outils qui répondent au même besoin, avec leur note et leur tarif d'entrée.
Le chatbot chinois aux modèles ouverts, très bon en code, et l'une des API les moins chères du marché.
Le chatbot chinois open-weight de Moonshot AI : le modèle géant K3, contexte d'un million de tokens, gratuit pour démarrer.
Les poids ouverts de Z.ai, un assistant gratuit et un forfait de codage à partir de 18 $/mois.
Qwen face aux autres
Nos comparatifs critère par critère, pour trancher.