Outils Intelligence Artificielle
Accueil/ Comparatifs/ Gemini vs Qwen
Comparatif · Assistants · 8 min de lecture

Gemini vs Qwen

Gemini 3.8 Flash face aux qwen3.8-max et qwen3.8-flash : scores datés, tarifs d'API relevés le 3 septembre 2026, poids ouverts et vitesse de génération.

Gemini vs Qwen
Le résumé en 20 secondes
Gemini
Gemini
LE PLUS RAPIDE ET LE PLUS INTÉGRÉ
4,4
Avantages
+ 59 sur l'index indépendant et 305 tokens/s mesurés+ Palier gratuit d'API, Batch à moitié prix+ Appli en français branchée sur Gmail, Docs et Android
Inconvénients
- Prix d'introduction qui double au 1er janvier 2027- Aucun poids public, sortie plafonnée à 64k tokens- Très verbeux, donc plus de tokens consommés par tâche
Qwen
Qwen
LE MEILLEUR RAPPORT PRIX ET LIBERTÉ
4,4
Avantages
+ Flash à 0,15/0,47 $ et Max à 2/6 $, sans échéance+ Poids ouverts auto-hébergeables, sortie jusqu'à 128k tokens+ Coding Plan à 50 $/mois, compatible Claude Code et Codex
Inconvénients
- Génération mesurée 4 à 8 fois plus lente- Aucun quota gratuit sur les modèles 3.8- Données hébergées à Singapour et en Chine continentale

Même numéro « 3.8 », deux éditeurs qui ne jouent pas la même partie. Google a lancé Gemini 3.8 Flash le 2 septembre, troisième Flash en six semaines ; Alibaba aligne depuis août le vaisseau amiral qwen3.8-max, aux poids ouverts, et un qwen3.8-flash cinq fois moins cher en entrée. Presque tous les comparatifs visibles sur ce sujet confrontent des versions périmées : ce face-à-face relève lui-même les prix au rendu du jour et date chaque score.

Critère
GeminiGemini
QwenQwen
Modèles phares au 3 septembre 2026
Gemini 3.8 Flash (GA) et Gemini 3.1 Pro (aperçu)
qwen3.8-max et qwen3.8-flash
Intelligence Index v4.1.1, relevé du 3 septembre
59 pour Gemini 3.8 Flash (high)
58 pour Qwen3.8-Max, 56 pour Flash-Next
Prix API du Flash, entrée et sortie
0,75 $ et 3,75 $ jusqu'au 31 décembre 2026, puis 1,50 $ et 7,50 $
0,15 $ et 0,47 $ sans échéance
Prix API du modèle haut de gamme
2 $ et 12 $ (Gemini 3.1 Pro, jusqu'à 200k tokens)
2 $ et 6 $ (qwen3.8-max)
Palier gratuit d'API
Oui, sur Gemini 3.8 Flash (contenus réutilisés)
Non, sur aucun des deux modèles 3.8
Poids téléchargeables
Aucun
Oui, Max et Flash ouverts (licences maison), gamme classique Apache 2.0
Contexte et sortie maximum
1M de contexte, 64k de sortie
1M de contexte, 128k de sortie
Vitesse mesurée (relevé du 3 septembre)
305 tokens/s
39 (Max) à 85 (Flash) tokens/s
Offre de code pour développeurs
API prépayée, Antigravity, abonnements Google AI
Coding Plan Pro à 50 $/mois, compatible Claude Code et Codex
Assistant gratuit en français
Oui, intégré à Gmail, Docs et Android
Oui, Qwen Studio traduit en français

AvantageEn retrait

Les deux interfaces en un coup d'œil

Aperçu de l'interface de Gemini
L'interface de Gemini · voir la fiche
Aperçu de l'interface de Qwen
L'interface de Qwen · voir la fiche
À retenir
Le plus rapide et le mieux intégréGemini 3.8 Flash, 305 tokens/s mesurés et une appli branchée sur l'écosystème Google.
Le moins cher au tokenQwen : 0,15/0,47 $ en Flash, 2/6 $ en Max, et des poids téléchargeables.
Le piègeLe prix affiché de Gemini 3.8 Flash double au 1er janvier 2027.

Deux « 3.8 », deux philosophies

Le calendrier a créé une collision de numéros. Qwen a déroulé sa génération 3.8 en août : qwen3.8-max, un mélange d'experts de 2 400 milliards de paramètres dont 95 actifs, en ligne le 3 août et ouvert en poids le 9, puis l'API qwen3.8-flash et les poids de Qwen3.8-Flash-Next le 26 août. Google a répondu le 2 septembre avec Gemini 3.8 Flash, que l'éditeur présente comme son troisième Flash en six semaines après les 3.6 et 3.7.

Même numéro, intentions opposées. Gemini 3.8 Flash est un modèle de milieu de gamme qui attaque plus haut : Google le décrit comme son Flash le plus intelligent, taillé pour le génie logiciel de longue haleine et les agents, avec des résultats annoncés sur DeepSWE v1.1, Vals Finance Agent V2 et Harvey's Legal Agent Benchmark, et 54,9 % sur HLE-Verified (chiffres de l'éditeur). Sa particularité est assumée : le modèle « travaille plus », enchaîne des étapes de raisonnement supplémentaires, appelle ses outils de façon itérative et « peut utiliser plus de tokens pour maximiser les performances ». Qwen3.8-Max joue la carte de la masse (2 400 milliards de paramètres, image, texte et vidéo en entrée, contexte d'un million de tokens) et qwen3.8-flash attaque par le prix.

Intelligence et vitesse : le relevé du 3 septembre

Au 3 septembre 2026, l'Intelligence Index v4.1.1 d'Artificial Analysis place les deux familles au même niveau, à un point près : 59 pour Gemini 3.8 Flash (high), 58 pour Qwen3.8-Max, 56 pour les poids de Qwen3.8-Flash-Next. La quasi-égalité entre le Flash de Google et le phare d'Alibaba est le fait marquant du relevé, avec deux réserves : l'index est remesuré en continu et son barème a été révisé début août, et le modèle de Google est un Flash, pas un modèle haut de gamme.

L'écart se creuse sur la vitesse et l'appétit en tokens. Le Flash de Google génère 305 tokens par seconde dans les mesures d'Artificial Analysis, contre 39 pour Qwen3.8-Max et 85 pour Flash-Next. Les deux familles consomment beaucoup : 120 millions de tokens de sortie pour boucler l'index côté Gemini (médiane à 71 millions), 140 millions côté Qwen3.8-Max. C'est le revers du « travaille plus » : plus d'étapes, plus de tokens, donc un coût par tâche qui ne se lit pas sur le prix du token.

Le duel en quatre nombres, relevé du 3 septembre 2026
59
Gemini 3.8 Flash (high) sur l'Intelligence Index v4.1.1 d'Artificial Analysis
58
Qwen3.8-Max sur le même index, relevé le même jour
305 tokens/s
La vitesse mesurée du Flash de Google, contre 39 pour Qwen3.8-Max
825,83 $
Le coût total mesuré pour évaluer Gemini 3.8 Flash sur l'index, contre 1 395,05 $ pour Qwen3.8-Max

Prix : Qwen imbattable au token, Google gratuit à l'entrée

Les grilles relevées le 3 septembre 2026 sur les pages officielles (ai.google.dev côté Google, Model Studio région internationale côté Alibaba), par million de tokens :

Modèle (API)EntréeSortieÀ savoir
gemini-3.8-flash0,75 $ jusqu'au 31 décembre, puis 1,50 $3,75 $, puis 7,50 $Palier gratuit, Batch à moitié prix
qwen3.8-flash0,15 $0,47 $Cache implicite à 0,016 $
Gemini 3.1 Pro (aperçu)2 $ jusqu'à 200k tokens, 4 $ au-delà12 $, puis 18 $Pas de palier gratuit
qwen3.8-max2 $6 $Cache implicite à 0,25 $

Pendant l'offre d'introduction, qwen3.8-flash coûte cinq fois moins cher en entrée et huit fois moins en sortie que Gemini 3.8 Flash. À partir du 1er janvier 2027, ce sera dix et seize fois.

!
Le prix affiché de Gemini 3.8 Flash n'est pas son prix

L'offre d'introduction de 0,75 $ et 3,75 $ le million de tokens expire le 31 décembre 2026. À compter du 1er janvier 2027, la grille passe à 1,50 $ en entrée et 7,50 $ en sortie, le double. Google applique la même bascule à Gemini 3.7 et 3.6 Flash. Tout calcul de coût au volume doit se faire sur les prix de croisière, pas sur le tarif de lancement.

L'asymétrie la plus méconnue joue en faveur de Google : l'API Gemini conserve un palier gratuit sur 3.8 Flash, à condition d'accepter que les contenus servent à améliorer les produits Google (le palier payant y est exclu). Alibaba n'affiche aucun quota gratuit sur qwen3.8-max ni sur qwen3.8-flash : la fiche modèle indique « Free Quota : Not Supported », le quota de bienvenue de 90 jours ne couvre pas ces deux modèles. Côté abonnements, Alibaba vend un Coding Plan Pro à 50 $ par mois (6 000 requêtes par 5 heures, 45 000 par semaine, l'offre Lite étant fermée aux nouveaux abonnés depuis mars 2026), branchable dans Claude Code, Codex ou Cursor grâce à un endpoint compatible Anthropic. Google n'a pas d'équivalent : l'usage intensif passe par l'API prépayée ou les abonnements Google AI (à partir de 4,99 € par mois, Pro à 21,99 €) qui relèvent aussi les limites d'Antigravity, la plateforme agentique gratuite dont 3.8 Flash est devenu le modèle par défaut.

Astuce

Le niveau de raisonnement pèse sur la facture des deux côtés. Gemini 3.8 Flash se règle sur low, medium ou high (medium par défaut) et Qwen active ou coupe sa réflexion avec enable_thinking. Sur les tâches simples, descendre d'un cran réduit les tokens consommés, la vraie variable de coût de ces modèles verbeux.

Poids ouverts ou API : la sortie de secours décide

C'est la différence structurelle du duel. Qwen publie ses poids : la gamme classique reste sous Apache 2.0, Qwen3.8-Max passe sous licence maison (nom à afficher au-delà de 100 millions d'utilisateurs mensuels, accord séparé pour l'hébergement commercial au-delà de 50 millions de dollars de revenus annuels) et Qwen3.8-Flash-Next sous Qwen Community License 1.0, plus exigeante encore (accord séparé pour toute offre hébergée commerciale). Gemini ne publie rien : tout passe par l'API, les applis ou les plateformes de Google.

La page d'accueil de Gemini en français, avec le sélecteur de modèle Flash.
La page d'accueil de Gemini en français, avec le sélecteur de modèle Flash.

À l'usage grand public, les deux assistants sont gratuits et parlent français. L'appli Gemini est native en français et intégrée à Gmail, Docs et Android, la version gratuite s'appuyant sur Gemini 3.6 Flash (3.8 Flash est réservé aux abonnés Google AI Pro et Ultra, précise le billet d'annonce). Qwen Studio, gratuit lui aussi, affiche une interface entièrement traduite et sert le texte, les images et la voix.

Qwen Studio, l'assistant gratuit d'Alibaba, entièrement traduit en français.
Qwen Studio, l'assistant gratuit d'Alibaba, entièrement traduit en français.

Sur la confidentialité, chacun a son point noir et sa parade. Le palier gratuit de l'API Gemini réutilise les contenus pour l'entraînement, le palier payant s'y refuse ; Alibaba indique un stockage à Singapour et en Chine continentale et une réutilisation des contenus dé-identifiés, mais offre une échappatoire que Google n'a pas : auto-héberger les poids. Dernier détail qui compte pour les gros travaux : la sortie maximum atteint 128k tokens chez Qwen contre 64k chez Gemini 3.8 Flash, et en API les deux familles acceptent l'image, le texte et la vidéo en entrée pour ne rendre que du texte.

Le verdict : Gemini ou Qwen selon votre profil

Choisissez Gemini si vous vivez dans l'écosystème Google, si vos agents enchaînent des allers-retours rapides ou si vous voulez démarrer sans dépenser un centime : palier gratuit d'API, appli gratuite en français, et 3.8 Flash dès l'abonnement Google AI Pro. Signez en connaissance de cause : les prix doublent en janvier.

Choisissez Qwen si vos volumes sont gros et vos marges comptent, si vous voulez héberger vos poids ou dépasser les 64k tokens de sortie : qwen3.8-flash à 0,15/0,47 $ sans échéance, qwen3.8-max à 2/6 $, et un Coding Plan à 50 $ par mois pour coder en agent dans Claude Code ou Codex.

Beaucoup d'équipes combinent les deux, Gemini pour la réactivité et l'intégration, Qwen pour le débit et l'auto-hébergement. Pour prolonger : notre comparatif Qwen contre GLM confronte les poids ouverts chinois entre eux, et Claude contre Gemini traite l'autre grand duel d'assistants.

Questions fréquentes

Lequel est le plus intelligent, Gemini 3.8 Flash ou Qwen3.8-Max ?

Au relevé du 3 septembre 2026, Gemini 3.8 Flash (high) pointe à 59 sur l'Intelligence Index v4.1.1 d'Artificial Analysis contre 58 pour Qwen3.8-Max : une quasi-égalité, sur un index remesuré en continu, où l'écart se joue dans la marge d'erreur.

Gemini 3.8 Flash est-il gratuit ?

L'API a un palier gratuit (les contenus servent alors à améliorer les produits Google) et l'appli gratuite reste sur Gemini 3.6 Flash ; dans l'appli, 3.8 Flash demande un abonnement Google AI Pro ou Ultra.

Qwen3.8 est-il open source ?

Ses poids sont publiés mais sous licences maison : Qwen3.8-Max License et Qwen Community License 1.0 exigent un accord séparé pour l'hébergement commercial, la gamme classique restant sous Apache 2.0. On parle de poids ouverts, pas d'open source.

Peut-on payer un forfait pour coder avec ?

Alibaba vend un Coding Plan Pro à 50 $ par mois (6 000 requêtes par 5 heures), compatible Claude Code, Codex et Cursor via un endpoint Anthropic. Google n'a pas d'équivalent : l'usage intensif passe par l'API prépayée ou les abonnements Google AI.

Où passent mes données ?

Chez Google, le palier payant de l'API est exclu de l'amélioration des produits, le palier gratuit non. Chez Alibaba, l'assistant hébergé stocke à Singapour et en Chine continentale et réutilise les contenus dé-identifiés : l'auto-hébergement des poids reste la seule garantie totale.

Autres comparatifs