Outils Intelligence Artificielle
Accueil/ Annuaire/ Chatbots & agents/ Qwen
Qwen

Qwen

GRATUIT

La famille de modèles ouverts d'Alibaba : des poids téléchargeables, de 0,8 à 2 400 milliards de paramètres, et un assistant gratuit, Qwen Studio.

4,4 · Note de la rédaction : 4,4 sur 5 Alibaba Web · iOS · Android · API · Local

Note de la rédaction, basée sur l'analyse des avis utilisateurs et de la documentation disponible.

Aperçu de l'interface

À quoi sert Qwen ?

Qwen (通义千问, Tongyi Qianwen) n'est pas un produit mais une famille de modèles d'IA, celle d'Alibaba. On y accède de trois manières très différentes, et c'est justement ce qui fait son intérêt : par Qwen Studio, l'assistant grand public gratuit (l'ancien « Qwen Chat », rebaptisé depuis) ; par l'API d'Alibaba Cloud Model Studio ; ou en téléchargeant les poids pour les exécuter sur sa propre machine, avec Ollama, llama.cpp ou vLLM.

C'est ce troisième chemin qui le distingue vraiment. Là où ChatGPT ne s'utilise que chez son éditeur, Alibaba publie ses poids, sous licence Apache 2.0 pour la gamme classique, sans clause de repartage ni seuil d'utilisateurs. Et la gamme est vertigineuse : plus de 450 modèles publiés sur Hugging Face, du modèle de 0,8 milliard de paramètres qui tient sur un portable aux 2 400 milliards de Qwen3.8-Max, plus des déclinaisons code, vision, transcription, synthèse vocale et image. Aucune autre famille n'est aussi déclinée, d'où son statut de choix par défaut chez qui fait tourner un modèle chez soi ou chez un hébergeur européen.

La page de l'organisation Qwen sur Hugging Face : plus de 93 000 abonnés, 35 collections et 185 contributeurs pour la famille de modèles d'Alibaba Cloud.
La page de l'organisation Qwen sur Hugging Face : plus de 93 000 abonnés, 35 collections et 185 contributeurs pour la famille de modèles d'Alibaba Cloud.
Qwen en chiffres
450+
modèles publiés sur Hugging Face
0,8 à 397 Md
de paramètres selon les variantes ouvertes
Apache 2.0
la licence de tous les poids ouverts

Où en est la famille Qwen en 2026 ?

Attention au piège de version : la génération ouverte et la génération commerciale ne portent pas les mêmes numéros. Côté poids ouverts, la dernière en date est Qwen3.8-Flash-Next, sortie le 26 août 2026 : 125 milliards de paramètres dont 6 actifs, plus 51 milliards de N-gram, présentée comme l'antichambre de l'architecture Qwen4, sous Qwen Community License 1.0. Elle suit Qwen3.8-27B, un dense publié en août sous licence Apache 2.0, et les poids de Qwen3.8-Max, 2 400 milliards de paramètres dont 95 actifs, en ligne depuis le 9 août sous licence maison. Côté API, le vaisseau amiral est Qwen3.8-Max, aux côtés de Qwen3.7 Max, Qwen3.7 Plus et Qwen3.7 Flash, et la version de production du modèle Flash, Qwen3.8-Flash, est désormais servie à 0,15 $ le million de tokens en entrée et 0,47 $ en sortie (relevé du 31 août 2026). Le détail est dans notre analyse de Qwen3.8-Max et notre analyse de Qwen3.8-Flash.

Les grandes étapes
11 avril 2023Alibaba Cloud dévoile Tongyi Qianwen, l'ancêtre de la famille Qwen.
Septembre 2025Qwen3-Next-80B-A3B inaugure un mélange d'experts ultra-clairsemé à attention hybride.
16 février 2026Qwen3.5 : un mélange d'experts de 397 milliards de paramètres, une base vision-langage unifiée et 201 langues et dialectes annoncés.
Février-mars 2026Déclinaison de Qwen3.5 en 122B-A10B, 35B-A3B, 27 B, puis 9 B, 4 B, 2 B et 0,8 B.
16 et 22 avril 2026Qwen3.6-35B-A3B puis Qwen3.6-27B, taillés pour le code agentique.
Mai 2026Qwen3.7 Max, vaisseau amiral propriétaire, réservé à l'API.
3 août 2026Qwen3.8-Max, 2 400 milliards de paramètres dont 95 actifs, est annoncé avec une promesse d'ouverture des poids.
9 août 2026Premier commit des poids de Qwen3.8-Max sur Hugging Face, à 05 h 56 heure de Paris, sous licence maison (Qwen3.8-Max License).
26 août 2026Qwen ouvre les poids de Qwen3.8-Flash-Next : 125 milliards de paramètres principaux dont 6 actifs, plus 51 milliards de N-gram et 4 milliards pour le MTP, présenté comme l'antichambre de l'architecture Qwen4. Voir notre analyse de Qwen3.8-Flash.

Artificial Analysis désignait le 30 avril 2026 Qwen3.6-27B comme « le nouveau leader des modèles à poids ouverts sous 150 milliards de paramètres », à 46 points sur son Intelligence Index, avec une réserve : il consomme environ 3,7 fois plus de tokens de sortie que Gemma 4 31B pour passer le même indice. Le propriétaire Qwen3.7 Max, lui, atteignait 56,6 points le 21 mai 2026 : « au plus près de la frontière », sans rejoindre OpenAI, Anthropic ni Google.

!
Ces deux scores ne se comparent pas aux relevés d'aujourd'hui

Les 46 et 56,6 points ci-dessus ont été mesurés sur une version antérieure de l'Intelligence Index. Artificial Analysis en est à la v4.1.1 depuis début août 2026, avec neuf épreuves et une pondération révisée : sur ce barème, au relevé du 7 août 2026, Qwen3.7 Max obtient 46,7 et Qwen3.8-Max 58,1. Comparer un score de mai à un score d'août revient à comparer deux règles différentes. Réclamez toujours la version de l'indice avec le chiffre.

Qwen est-il gratuit ?

Oui : Qwen Studio est gratuit, en web comme en application mobile, et l'éditeur ne publie à ce jour aucune offre d'abonnement grand public (la seule offre par abonnement vise les développeurs : un Coding Plan à 50 $ par mois, relevé le 31 août 2026, détaillé dans notre comparatif Qwen contre GLM et confronté à Google dans notre comparatif Gemini contre Qwen). L'interface est traduite en français et donne accès au chat, à la génération et à l'édition d'images, à la lecture de documents et au mode vocal.

L'assistant Qwen Studio, entièrement traduit en français, avec le modèle Qwen3.7-Plus sélectionné par défaut.
L'assistant Qwen Studio, entièrement traduit en français, avec le modèle Qwen3.7-Plus sélectionné par défaut.

Les développeurs, eux, paient à l'usage sur Alibaba Cloud Model Studio. Voici les tarifs publics de la région internationale (Singapour), au million de tokens :

Modèle (API)EntréeSortiePoids
qwen3.8-max2,00 $6,00 $Ouverts depuis le 9 août, licence maison
qwen3.8-flash0,15 $0,47 $API ouverte ; poids ouverts (Flash-Next), licence maison
qwen3.7-max2,50 $7,50 $Propriétaire
qwen3.7-plus0,40 $1,60 $Propriétaire
qwen3.7-flash0,03 $0,13 $Propriétaire
qwen3.6-flash0,25 $1,50 $Ouverts (Qwen3.6-35B-A3B)
qwen3.5-flash0,10 $0,40 $Ouverts

Les quatre premières lignes ont été relevées le 7 août 2026 sur la documentation QwenCloud et sur la fiche officielle qwen3.8-max (déploiement international, hors promotions et hors remises de cache). La ligne qwen3.8-flash a été re-relevée le 31 août 2026 sur Model Studio : l'API de la version production est ouverte (l'annonce du 26 août 2026 affichait 0,16 $ en entrée, la grille en sert 0,15 $). Le tarif de qwen3.7-flash vaut jusqu'à 32 000 tokens en entrée par requête, celui de qwen3.7-plus jusqu'à 256 000 ; au-delà, ils augmentent. Sur qwen3.8-max, le cache implicite est facturé 0,25 $ en entrée. Les lignes qwen3.6-flash et qwen3.5-flash datent du relevé du 27 juillet 2026 et ne figurent plus sur la page de tarifs actuelle. Chaque nouveau compte reçoit un quota gratuit, valable 90 jours, mais les fiches modèles qwen3.8-max et qwen3.8-flash affichent « Free Quota : Not Supported » au relevé du 3 septembre 2026 : ce quota de bienvenue ne couvre pas ces deux modèles.

Ce qu'en disent les utilisateurs

Sur r/LocalLLaMA, le fil consacré à la sortie de Qwen3.6 raconte une session de programmation autonome menée sur une simple RTX 4090, avec la variante 35B-A3B :

Je lui ai donné pour tâche de construire un jeu de tower defense (…). Mon Dieu, il le fait vraiment. Il teste maintenant la fonction d'amélioration, il a remarqué à un moment que le canevas ne s'affichait pas, l'a vu et l'a corrigé. Il a repéré son propre bug dans la validation des vagues et il est en train de le régler… Je suis bluffé.
u/Local-Cardiologist-5, r/LocalLLaMA, 17 avril 2026 · traduit de l'anglais

Les mêmes fils rappellent que « petit » ne veut pas dire « équivalent » : u/NNN_Throwaway2 notait le 23 avril 2026 que le modèle de 397 milliards de paramètres « avait bien plus de connaissances du monde et une bien meilleure cohérence logique sur les contextes longs et les tâches complexes », des dimensions « que les benchmarks actuels ne capturent pas vraiment ».

Où vont vos données avec Qwen ?

C'est le point de vigilance, et il mérite d'être dit précisément. L'assistant est édité par Alibaba Cloud (Singapore) Private Limited. Sa politique de confidentialité (mise à jour le 19 mai 2026) indique noir sur blanc que les données personnelles sont stockées ou traitées « à Singapour et en Chine continentale », avec un accès distant encadré depuis ces deux pays. Elle précise aussi que les contenus utilisateurs dé-identifiés et les retours servent à « entraîner et améliorer » les services, modèles d'IA compris, au titre de l'intérêt légitime.

!
Ce que ça implique concrètement

Pour un dossier client, un contrat ou des données personnelles, l'application hébergée n'est pas le bon véhicule : une entreprise chinoise reste soumise à la législation locale. L'atout de Qwen, ici, c'est qu'il offre une porte de sortie que peu d'assistants proposent : les poids ouverts s'auto-hébergent, et la donnée ne quitte alors jamais votre infrastructure. Alibaba applique par ailleurs à ses propres salariés une prudence symétrique vis-à-vis des outils américains, comme le montre son bannissement de Claude Code.

Qwen, DeepSeek ou Mistral ?

Face aux autres modèles ouverts chinois, Qwen se distingue moins par la puissance brute que par l'étendue de la gamme et la clarté de sa licence : DeepSeek reste la référence du rapport qualité/prix en API, Kimi joue le contexte long et les très gros modèles. Voir notre suivi de la publication des poids de Kimi K3. Pour des serveurs européens, le comparable direct est Le Chat de Mistral ; les trois figurent dans notre catégorie Chatbots & agents.

À retenir
Idéal pourFaire tourner un bon modèle chez soi ou chez un hébergeur européen, surtout pour le code.
TarifAssistant Qwen Studio gratuit ; poids ouverts gratuits (Apache 2.0 pour la gamme classique, licences maison pour Max et Flash) ; API dès 0,03 $/M tokens.
LimiteEn version hébergée, données stockées à Singapour et en Chine continentale, et réutilisées pour l'entraînement.

Questions fréquentes

Qwen est-il gratuit ?

Oui. L'assistant Qwen Studio est gratuit sur le web et en application mobile, sans abonnement payant publié à ce jour, et les poids des modèles ouverts se téléchargent librement. Seule l'API d'Alibaba Cloud Model Studio est facturée à l'usage, à partir de 0,03 $ par million de tokens en entrée sur qwen3.7-flash, tarif relevé le 7 août 2026.

C'est quoi Qwen ?

La famille de modèles d'intelligence artificielle d'Alibaba (Tongyi Qianwen en chinois) : plus de 450 modèles publiés, du texte au code, à la vision, à l'audio et à l'image, accessibles via l'assistant Qwen Studio, une API, ou en téléchargement.

Qu'est-ce que Qwen3.8-Max ?

Le modèle le plus puissant de la famille, publié le 3 août 2026 : 2 400 milliards de paramètres dont 95 activés par token, appelable par API à 2 $ le million de tokens en entrée. Alibaba annonce l'ouverture de ses poids, une première pour la gamme Max. Détails dans notre analyse de Qwen3.8-Max et notre comparatif Qwen contre DeepSeek.

Qwen est-il open source ?

Ses poids sont publiés sous licence Apache 2.0 pour la gamme classique, ce qui autorise l'usage commercial, la modification et la redistribution. Les modèles récents de classe Max et Flash sont sous licences maison : Qwen3.8-Max License et Qwen Community License 1.0, qui exigent un accord séparé pour l'hébergement commercial. On parle plutôt de « poids ouverts » que d'open source : les données et le code d'entraînement ne sont pas publiés.

Qwen parle-t-il français ?

L'interface de Qwen Studio est entièrement traduite en français et Alibaba annonce 201 langues et dialectes pris en charge depuis Qwen3.5. La qualité rédactionnelle en français reste toutefois peu évaluée par des sources indépendantes : à éprouver sur vos propres cas.

Peut-on installer Qwen sur son ordinateur ?

Oui, c'est même son principal atout. Les modèles ouverts vont de 0,8 à 2 400 milliards de paramètres et s'installent en une commande via Ollama, llama.cpp ou vLLM ; les petites tailles tournent sur un portable récent, les grandes demandent du matériel de serveur.

Qwen est-il sûr pour des données professionnelles ?

Dans sa version hébergée, à manier avec précaution : la politique de confidentialité indique un stockage à Singapour et en Chine continentale et une réutilisation des contenus dé-identifiés pour l'entraînement. Pour des données sensibles, préférez l'auto-hébergement des poids ouverts.

Points forts & limites

On aime
+ Poids publiés et téléchargeables, sous licence Apache 2.0 pour la gamme classique, sans clause de repartage+ La gamme la plus complète : de 0,8 à 397 milliards de paramètres, plus des variantes code, vision, audio et image+ Assistant Qwen Studio gratuit, sans abonnement, et API internationale parmi les moins chères
On aime moins
- Éditeur chinois : les données de l'assistant sont stockées à Singapour et en Chine continentale- Les contenus utilisateurs dé-identifiés servent à entraîner les modèles, au titre de l'intérêt légitime- Les poids récents de classe Max et Flash sont sous licences maison : accord séparé requis pour l'hébergement commercial et les assistants de travail IA
Astuce

Pour un dossier confidentiel, ne passez pas par l'application : téléchargez les poids (Apache 2.0) et faites-les tourner en local ou chez un hébergeur européen. C'est le seul moyen d'être certain que vos contenus ne quittent pas votre infrastructure.

Cas d'usage typiques

01
Faire tourner un modèle en local
Des tailles de 0,8 à 397 milliards de paramètres, en Apache 2.0, exécutables via Ollama, llama.cpp ou vLLM.
02
Coder et automatiser
Une génération orientée code et tâches d'agent, avec Qwen Code, l'agent de terminal open source maison.
03
Discuter gratuitement
L'assistant Qwen Studio (texte, images, documents, voix) est gratuit et son interface est traduite en français.

Qwen face aux autres

Nos comparatifs critère par critère, pour trancher.