Même numéro « 3.8 », deux éditeurs qui ne jouent pas la même partie. Google a lancé Gemini 3.8 Flash le 2 septembre, troisième Flash en six semaines ; Alibaba aligne depuis août le vaisseau amiral qwen3.8-max, aux poids ouverts, et un qwen3.8-flash cinq fois moins cher en entrée. Presque tous les comparatifs visibles sur ce sujet confrontent des versions périmées : ce face-à-face relève lui-même les prix au rendu du jour et date chaque score.
AvantageEn retrait
Les deux interfaces en un coup d'œil
Deux « 3.8 », deux philosophies
Le calendrier a créé une collision de numéros. Qwen a déroulé sa génération 3.8 en août : qwen3.8-max, un mélange d'experts de 2 400 milliards de paramètres dont 95 actifs, en ligne le 3 août et ouvert en poids le 9, puis l'API qwen3.8-flash et les poids de Qwen3.8-Flash-Next le 26 août. Google a répondu le 2 septembre avec Gemini 3.8 Flash, que l'éditeur présente comme son troisième Flash en six semaines après les 3.6 et 3.7.
Même numéro, intentions opposées. Gemini 3.8 Flash est un modèle de milieu de gamme qui attaque plus haut : Google le décrit comme son Flash le plus intelligent, taillé pour le génie logiciel de longue haleine et les agents, avec des résultats annoncés sur DeepSWE v1.1, Vals Finance Agent V2 et Harvey's Legal Agent Benchmark, et 54,9 % sur HLE-Verified (chiffres de l'éditeur). Sa particularité est assumée : le modèle « travaille plus », enchaîne des étapes de raisonnement supplémentaires, appelle ses outils de façon itérative et « peut utiliser plus de tokens pour maximiser les performances ». Qwen3.8-Max joue la carte de la masse (2 400 milliards de paramètres, image, texte et vidéo en entrée, contexte d'un million de tokens) et qwen3.8-flash attaque par le prix.
Intelligence et vitesse : le relevé du 3 septembre
Au 3 septembre 2026, l'Intelligence Index v4.1.1 d'Artificial Analysis place les deux familles au même niveau, à un point près : 59 pour Gemini 3.8 Flash (high), 58 pour Qwen3.8-Max, 56 pour les poids de Qwen3.8-Flash-Next. La quasi-égalité entre le Flash de Google et le phare d'Alibaba est le fait marquant du relevé, avec deux réserves : l'index est remesuré en continu et son barème a été révisé début août, et le modèle de Google est un Flash, pas un modèle haut de gamme.
L'écart se creuse sur la vitesse et l'appétit en tokens. Le Flash de Google génère 305 tokens par seconde dans les mesures d'Artificial Analysis, contre 39 pour Qwen3.8-Max et 85 pour Flash-Next. Les deux familles consomment beaucoup : 120 millions de tokens de sortie pour boucler l'index côté Gemini (médiane à 71 millions), 140 millions côté Qwen3.8-Max. C'est le revers du « travaille plus » : plus d'étapes, plus de tokens, donc un coût par tâche qui ne se lit pas sur le prix du token.
Prix : Qwen imbattable au token, Google gratuit à l'entrée
Les grilles relevées le 3 septembre 2026 sur les pages officielles (ai.google.dev côté Google, Model Studio région internationale côté Alibaba), par million de tokens :
| Modèle (API) | Entrée | Sortie | À savoir |
|---|---|---|---|
| gemini-3.8-flash | 0,75 $ jusqu'au 31 décembre, puis 1,50 $ | 3,75 $, puis 7,50 $ | Palier gratuit, Batch à moitié prix |
| qwen3.8-flash | 0,15 $ | 0,47 $ | Cache implicite à 0,016 $ |
| Gemini 3.1 Pro (aperçu) | 2 $ jusqu'à 200k tokens, 4 $ au-delà | 12 $, puis 18 $ | Pas de palier gratuit |
| qwen3.8-max | 2 $ | 6 $ | Cache implicite à 0,25 $ |
Pendant l'offre d'introduction, qwen3.8-flash coûte cinq fois moins cher en entrée et huit fois moins en sortie que Gemini 3.8 Flash. À partir du 1er janvier 2027, ce sera dix et seize fois.
L'offre d'introduction de 0,75 $ et 3,75 $ le million de tokens expire le 31 décembre 2026. À compter du 1er janvier 2027, la grille passe à 1,50 $ en entrée et 7,50 $ en sortie, le double. Google applique la même bascule à Gemini 3.7 et 3.6 Flash. Tout calcul de coût au volume doit se faire sur les prix de croisière, pas sur le tarif de lancement.
L'asymétrie la plus méconnue joue en faveur de Google : l'API Gemini conserve un palier gratuit sur 3.8 Flash, à condition d'accepter que les contenus servent à améliorer les produits Google (le palier payant y est exclu). Alibaba n'affiche aucun quota gratuit sur qwen3.8-max ni sur qwen3.8-flash : la fiche modèle indique « Free Quota : Not Supported », le quota de bienvenue de 90 jours ne couvre pas ces deux modèles. Côté abonnements, Alibaba vend un Coding Plan Pro à 50 $ par mois (6 000 requêtes par 5 heures, 45 000 par semaine, l'offre Lite étant fermée aux nouveaux abonnés depuis mars 2026), branchable dans Claude Code, Codex ou Cursor grâce à un endpoint compatible Anthropic. Google n'a pas d'équivalent : l'usage intensif passe par l'API prépayée ou les abonnements Google AI (à partir de 4,99 € par mois, Pro à 21,99 €) qui relèvent aussi les limites d'Antigravity, la plateforme agentique gratuite dont 3.8 Flash est devenu le modèle par défaut.
Le niveau de raisonnement pèse sur la facture des deux côtés. Gemini 3.8 Flash se règle sur low, medium ou high (medium par défaut) et Qwen active ou coupe sa réflexion avec enable_thinking. Sur les tâches simples, descendre d'un cran réduit les tokens consommés, la vraie variable de coût de ces modèles verbeux.
Poids ouverts ou API : la sortie de secours décide
C'est la différence structurelle du duel. Qwen publie ses poids : la gamme classique reste sous Apache 2.0, Qwen3.8-Max passe sous licence maison (nom à afficher au-delà de 100 millions d'utilisateurs mensuels, accord séparé pour l'hébergement commercial au-delà de 50 millions de dollars de revenus annuels) et Qwen3.8-Flash-Next sous Qwen Community License 1.0, plus exigeante encore (accord séparé pour toute offre hébergée commerciale). Gemini ne publie rien : tout passe par l'API, les applis ou les plateformes de Google.

À l'usage grand public, les deux assistants sont gratuits et parlent français. L'appli Gemini est native en français et intégrée à Gmail, Docs et Android, la version gratuite s'appuyant sur Gemini 3.6 Flash (3.8 Flash est réservé aux abonnés Google AI Pro et Ultra, précise le billet d'annonce). Qwen Studio, gratuit lui aussi, affiche une interface entièrement traduite et sert le texte, les images et la voix.

Sur la confidentialité, chacun a son point noir et sa parade. Le palier gratuit de l'API Gemini réutilise les contenus pour l'entraînement, le palier payant s'y refuse ; Alibaba indique un stockage à Singapour et en Chine continentale et une réutilisation des contenus dé-identifiés, mais offre une échappatoire que Google n'a pas : auto-héberger les poids. Dernier détail qui compte pour les gros travaux : la sortie maximum atteint 128k tokens chez Qwen contre 64k chez Gemini 3.8 Flash, et en API les deux familles acceptent l'image, le texte et la vidéo en entrée pour ne rendre que du texte.
Le verdict : Gemini ou Qwen selon votre profil
Choisissez Gemini si vous vivez dans l'écosystème Google, si vos agents enchaînent des allers-retours rapides ou si vous voulez démarrer sans dépenser un centime : palier gratuit d'API, appli gratuite en français, et 3.8 Flash dès l'abonnement Google AI Pro. Signez en connaissance de cause : les prix doublent en janvier.
Choisissez Qwen si vos volumes sont gros et vos marges comptent, si vous voulez héberger vos poids ou dépasser les 64k tokens de sortie : qwen3.8-flash à 0,15/0,47 $ sans échéance, qwen3.8-max à 2/6 $, et un Coding Plan à 50 $ par mois pour coder en agent dans Claude Code ou Codex.
Beaucoup d'équipes combinent les deux, Gemini pour la réactivité et l'intégration, Qwen pour le débit et l'auto-hébergement. Pour prolonger : notre comparatif Qwen contre GLM confronte les poids ouverts chinois entre eux, et Claude contre Gemini traite l'autre grand duel d'assistants.
Questions fréquentes
Lequel est le plus intelligent, Gemini 3.8 Flash ou Qwen3.8-Max ?
Au relevé du 3 septembre 2026, Gemini 3.8 Flash (high) pointe à 59 sur l'Intelligence Index v4.1.1 d'Artificial Analysis contre 58 pour Qwen3.8-Max : une quasi-égalité, sur un index remesuré en continu, où l'écart se joue dans la marge d'erreur.
Gemini 3.8 Flash est-il gratuit ?
L'API a un palier gratuit (les contenus servent alors à améliorer les produits Google) et l'appli gratuite reste sur Gemini 3.6 Flash ; dans l'appli, 3.8 Flash demande un abonnement Google AI Pro ou Ultra.
Qwen3.8 est-il open source ?
Ses poids sont publiés mais sous licences maison : Qwen3.8-Max License et Qwen Community License 1.0 exigent un accord séparé pour l'hébergement commercial, la gamme classique restant sous Apache 2.0. On parle de poids ouverts, pas d'open source.
Peut-on payer un forfait pour coder avec ?
Alibaba vend un Coding Plan Pro à 50 $ par mois (6 000 requêtes par 5 heures), compatible Claude Code, Codex et Cursor via un endpoint Anthropic. Google n'a pas d'équivalent : l'usage intensif passe par l'API prépayée ou les abonnements Google AI.
Où passent mes données ?
Chez Google, le palier payant de l'API est exclu de l'amélioration des produits, le palier gratuit non. Chez Alibaba, l'assistant hébergé stocke à Singapour et en Chine continentale et réutilise les contenus dé-identifiés : l'auto-hébergement des poids reste la seule garantie totale.