GLM-5.3 et DeepSeek-V4-Pro-0813 sont sortis à un jour d'écart en août 2026, et presque toute la comparaison disponible en ligne oppose encore des versions périmées. Ce face-à-face relève lui-même ses chiffres : index Artificial Analysis v4.1.1 au 1ᵉʳ septembre, grilles de tarifs officielles après la hausse de DeepSeek, licences lues dans les textes.
AvantageEn retrait
Les deux interfaces en un coup d'œil
Benchmarks
Les trois épreuves de l'index où les deux phares sont mesurés au même réglage, relevées le 1ᵉʳ septembre 2026 et classées du plus petit écart au plus grand. Scores sur 100. Attention à la règle du jeu : l'Intelligence Index en est à sa version v4.1.1 (neuf épreuves, révisée début août) et les scores sont re-mesurés en continu, ne les comparez pas à un relevé antérieur.
Source : Artificial Analysis, Intelligence Index v4.1.1, relevé du 1ᵉʳ septembre 2026, mis à jour le 1ᵉʳ septembre 2026.
Les connaissances scientifiques sont quasi à égalité, avec un léger avantage DeepSeek sur GPQA Diamond, et l'écart le plus grand va à GLM-5.3 sur l'agent en terminal : c'est lui qui fait la différence à l'index composite (59,5 contre 53,2). Le coût par tâche complète le tableau dans l'autre sens, 0,68 $ pour GLM-5.3 contre 0,27 $ pour DeepSeek V4 Pro, ce dernier consommant nettement moins de tokens. Réserve d'importance : les éditeurs s'attribuent sur leurs propres bancs 88,2 (Z.ai, Terminal-Bench v2.1) et 87,9 (DeepSeek, avec son DeepSeek Harness), contre 83,9 et 78,7 en mesure indépendante.
Voir les classements complets, à jour :
- Page Artificial Analysis de DeepSeek V4 Pro 0813 ↗
- Terminal-Bench v2.1 chez Artificial Analysis ↗
- Dépôt officiel DeepSeek-V4-Pro-0813 sur Hugging Face ↗
- Dépôt officiel GLM-5.3 sur Hugging Face ↗
- Grille de tarifs officielle de l'API DeepSeek ↗
- Grille de tarifs officielle Z.ai ↗
Deux versions officielles à un jour d'écart
Le 13 août, DeepSeek a fait passer DeepSeek-V4-Pro du statut de préversion à celui de version officielle (V4-Pro-0813) sur son application, son web et son API, avec des capacités d'agent « considérablement renforcées » selon son carnet de mise à jour. Le 14 août, Z.ai lançait GLM-5.3, publié en poids ouverts le 25.
GLM reste sur sa base de 744 milliards de paramètres dont 40 actifs, avec un raisonnement imposé (effort low, high ou max) et des sorties limitées au texte. DeepSeek joue la masse : environ 1 600 milliards de paramètres dont 49 actifs selon Artificial Analysis, jusqu'à 384 000 tokens en sortie, et un raisonnement désactivable avec les mêmes trois niveaux d'effort. Les deux partagent un contexte d'un million de tokens. Depuis le 21 août, DeepSeek propose même une variante expérimentale capable de lire les images (DeepSeek-V4-Flash-Vision-Exp), là où GLM-5.3 n'accepte que du texte.
Benchmarks : l'écart se creuse en agent
Les trois épreuves où les deux phares sont mesurés au même réglage racontent la même histoire en trois actes. Sur les sciences de niveau doctorat (GPQA Diamond), DeepSeek V4 Pro passe devant de justesse (92,8 contre 91,7). Sur les connaissances expertes (Humanity's Last Exam), l'écart tient en un point (42,3 pour GLM-5.3 contre 41,0). Puis il se creuse là où Z.ai a concentré son post-entraînement : en agent en terminal, GLM-5.3 mène 83,9 contre 78,7 à Terminal-Bench v2.1. C'est cette troisième ligne qui pèse dans l'index composite, et GLM-5.3-Flash (57,5) domine aussi sa catégorie face à DeepSeek-V4-Flash (51,8).
Deux réserves s'imposent. Les éditeurs s'attribuent de meilleurs scores sur leurs propres bancs : 88,2 annoncés par Z.ai pour GLM-5.3, 87,9 par DeepSeek pour V4-Pro-0813 avec son propre DeepSeek Harness. La mesure indépendante sépare nettement les deux. GLM-5.3 garde enfin l'avantage de vitesse : 71,6 tokens par seconde en sortie médiane contre 54,1 ; la variante DeepSeek-V4-Flash atteint pour sa part 107,9, la plus rapide des quatre.
Prix : même après sa hausse, DeepSeek reste le moins cher
C'est l'événement que les comparatifs plus anciens ignorent. Le 6 août, DeepSeek annonçait sur sa page de tarifs une hausse « générale et significative » ; elle est entrée en vigueur le 16 août à 18 h, heure de Paris, avec une nouveauté : des heures pleines et des heures creuses. Les heures pleines (3 h à 6 h et 8 h à 12 h, heure de Paris, du lundi au vendredi) facturent deepseek-v4-pro à 1,32 $ le million de tokens en entrée et 3,96 $ en sortie ; le reste du temps, week-ends compris, c'est la moitié (0,66 $ et 1,98 $). Avant la hausse, le modèle payait 0,435 $ et 0,87 $ à toute heure.
Malgré ce triplement, DeepSeek reste moins cher que GLM-5.3 (1,40 $ et 4,40 $), et l'écart explose sur le cache : 0,022 à 0,044 $ le million de tokens déjà en cache, contre 0,26 $ chez Z.ai. Artificial Analysis l'a chiffré à l'échelle de l'index entier : 0,27 $ par tâche pour DeepSeek V4 Pro contre 0,68 $ pour GLM-5.3, ce dernier consommant nettement plus de tokens, raison imposée et verbosité comprises.
En entrée de gamme, le rapport s'inverse : GLM-5.3-Flash (0,15 $ et 0,50 $ le million de tokens, moitié prix jusqu'au 9 septembre) est à la fois moins chère que DeepSeek-V4-Flash (0,44 $ et 1,32 $ en heures pleines) et mieux classée au même index. Enfin, DeepSeek ne vend aucun abonnement : son API se paie à l'usage, quand le GLM Coding Plan démarre à 18 $ par mois en Lite (80 $ en Pro, 168 $ en Max), crédits hebdomadaires et heures creuses à moitié prix.
Les heures pleines de DeepSeek couvrent 3 h à 6 h et 8 h à 12 h, heure de Paris, du lundi au vendredi. Tout le reste est à moitié prix : après-midi, soirées, nuits et week-ends entiers.
Depuis la France : la langue, les outils et les données

Pour un usage grand public, DeepSeek garde un net avantage : son application web et mobile est gratuite, l'interface s'affiche en français, et aucune limite de volume n'est publiée. L'assistant chat.z.ai, lui, ne s'affiche qu'en anglais.

Côté développeurs, les deux se branchent partout, mais pas par les mêmes portes. DeepSeek expose un endpoint au format OpenAI, un autre au format Anthropic, et une API Responses « spécifiquement adaptée pour Codex » avec script de configuration en une commande ; sa documentation couvre Claude Code, GitHub Copilot et OpenCode, et son propre cadre agent, DeepSeek Harness, est en préversion développeur. Le GLM Coding Plan, lui, est documenté pour Claude Code (GLM-5.3-Flash par défaut sur les trois niveaux de modèle), Cline, OpenCode, Kilo Code et OpenClaw, sans mention de Codex à ce jour.
Reste l'option de télécharger les poids, et les licences ne disent pas la même chose. DeepSeek-V4-Pro-0813 et V4-Flash-0731 sont sous MIT, sans la moindre condition ; GLM-5.2 et GLM-5.3-Flash sont sous MIT, quand GLM-5.3 y ajoute une clause : les activités de « modèle en service » dépassant 10 milliards de dollars de revenus sur douze mois consécutifs doivent passer une revue de sécurité Z.ai. DeepSeek offre donc le texte le plus simple, pour un modèle deux fois plus gros à héberger (environ 1 600 milliards de paramètres contre 744).
L'application DeepSeek traite les requêtes sur des serveurs en Chine, ce qui vaut au modèle des restrictions dans plusieurs pays sur les appareils officiels. L'assistant hébergé de Z.ai désigne une entité enregistrée à Singapour, indique un traitement « généralement » localisé là-bas, et prévoit la réutilisation des contenus pour entraîner ses modèles. Dans les deux cas, l'auto-hébergement des poids reste la seule garantie complète.
Le verdict : GLM ou DeepSeek selon votre profil
Choisissez GLM si vous codez en agent au quotidien : en tête du duel sur l'index indépendant et sur l'agent en terminal, plus rapide en sortie, un Coding Plan dès 18 $ par mois à brancher dans Claude Code, et des poids sous MIT pour héberger GLM-5.2 ou la variante Flash, à condition d'accepter une API plus chère par tâche terminée, un raisonnement imposé et une interface en anglais.
Choisissez DeepSeek si le budget pilote votre choix : le moins cher au million de tokens comme par tâche terminée, un cache quasi gratuit, un raisonnement désactivable, une variante vision expérimentale, une application en français et une licence MIT sans condition, quitte à concéder six points d'index et un agent en terminal moins bon.
Les deux se combinent bien : GLM pour l'agent en terminal, DeepSeek pour le volume à bas coût. Pour élargir aux autres modèles ouverts chinois, voir notre comparatif Qwen contre GLM et notre comparatif Qwen contre DeepSeek.
Questions fréquentes
GLM-5.3 est-il meilleur que DeepSeek V4 Pro ?
Sur l'index indépendant, oui : 59,5 contre 53,2 au relevé du 1ᵉʳ septembre 2026, avec l'écart le plus net en agent en terminal (83,9 contre 78,7). DeepSeek garde l'avantage sur les sciences (GPQA Diamond) et sur le coût par tâche terminée.
Lequel est le moins cher ?
DeepSeek V4 Pro : 1,32 $ et 3,96 $ le million de tokens en heures pleines (la moitié en heures creuses), contre 1,40 $ et 4,40 $ pour GLM-5.3, et environ 0,27 $ par tâche d'index contre 0,68 $. En entrée de gamme, GLM-5.3-Flash est moins chère que DeepSeek-V4-Flash.
GLM-5.3 et DeepSeek V4 sont-ils open source ?
Leurs poids sont publiés : MIT sans condition pour DeepSeek-V4-Pro-0813 et V4-Flash-0731 ; licence inspirée de la MIT avec revue de sécurité Z.ai pour les hébergeurs de « modèle en service » au-delà de 10 milliards de dollars de revenus pour GLM-5.3 (MIT sans condition pour GLM-5.2 et GLM-5.3-Flash).
Claude Code fonctionne-t-il avec les deux ?
Oui. Z.ai documente le branchement de son GLM Coding Plan dans Claude Code (GLM-5.3-Flash par défaut), et DeepSeek expose un endpoint au format Anthropic, documenté pour Claude Code, GitHub Copilot et OpenCode.
Codex peut-il utiliser ces modèles ?
DeepSeek, oui : son API Responses est « spécifiquement adaptée pour Codex » selon sa documentation, avec un script de configuration en une commande. Z.ai ne documente pas Codex pour son Coding Plan, qui vise Claude Code, Cline, OpenCode, Kilo Code et OpenClaw.
Peut-on faire tourner ces modèles chez soi ?
Non pour les phares : 744 milliards de paramètres pour GLM-5.3, environ 1 600 pour DeepSeek V4 Pro, un serveur multi-GPU dans les deux cas. Les variantes légères (320 Md et 284 Md) restent hors de portée d'un ordinateur personnel.