Outils Intelligence Artificielle
Accueil/ Actualités/ Stratégie/ DeepSeek annonce une hausse « significative » de son API : à partir de quand l'avantage disparaît
Stratégie · 7 min de lecture

DeepSeek annonce une hausse « significative » de son API : à partir de quand l'avantage disparaît

DeepSeek prévient sur sa propre documentation que ses tarifs d'API vont augmenter fortement. Voici ce qu'il coûte aujourd'hui face à OpenAI, Anthropic, Google, Mistral et Alibaba, et le seuil où son avantage s'efface.

Illustration

C'est une note de bas de tableau, quatre lignes sur une page de documentation technique, et elle vaut plus qu'un communiqué. Depuis le 6 août 2026, la page de tarifs de l'API DeepSeek prévient ses clients que les prix vont monter, « significativement », sans indiquer ni de combien ni quand.

L'entreprise de Hangzhou s'est fait connaître en cassant les prix de l'inférence. C'est même la seule raison pour laquelle beaucoup de développeurs francophones l'appellent plutôt qu'OpenAI ou Anthropic. Une hausse annoncée par l'éditeur lui-même change donc le calcul, et la vraie question n'est pas « de combien » mais « à partir de quel niveau DeepSeek cesse d'être le choix évident ».

À retenir · l'essentiel
Le faitDeepSeek annonce sur sa documentation une hausse générale et « significative » de ses tarifs d'API.
Ce qui est nouveauCette note a remplacé le 6 août une autre annonce, bien plus précise, qui promettait un doublement aux heures de pointe.
La marge réelleSur les tokens déjà en cache, DeepSeek peut multiplier son prix par 7 avant d'atteindre le modèle occidental le moins cher, et par 71 avant d'atteindre Claude Sonnet 5.
L'inconnueAucune explication officielle, aucune date, aucun pourcentage.

Ce que dit exactement l'avertissement

La note figure sous le tableau des tarifs, appelée par un renvoi placé sur la ligne « PRICING ». Elle tient en trois phrases.

Nous prévoyons de relever prochainement la tarification globale des services de l'API DeepSeek, avec une hausse significative attendue. Merci de planifier votre usage en conséquence. Le plan tarifaire précis fera l'objet d'une notification officielle.
Documentation officielle de l'API DeepSeek, note (2), relevée le 7 août 2026
La note (2), sous le tableau des tarifs de l'API DeepSeek, annonce une hausse générale « significative » sans chiffre ni date d'entrée en vigueur.
La note (2), sous le tableau des tarifs de l'API DeepSeek, annonce une hausse générale « significative » sans chiffre ni date d'entrée en vigueur.

Le même message s'affiche en bandeau bleu sur la page de consommation de la plateforme développeur, protégée par identification, ce qui explique que le fil Hacker News qui a fait circuler l'information pointait vers un lien inaccessible.

Un détail que personne n'a relevé rend cette note plus intéressante encore : elle en a remplacé une autre. Jusqu'au 5 août, le même renvoi annonçait une chose beaucoup plus précise, une tarification à heures pleines et heures creuses avec des prix doublés de 9 h à 12 h et de 14 h à 18 h, heure de Pékin, sur tous les postes de facturation. Cette formulation a disparu. L'archive de la page et l'en-tête `Last-Modified` du serveur situent la modification au 6 août 2026 à 6 h 32 UTC.

Ce qu'a écrit DeepSeek, et quand
24 avril 2026DeepSeek-V4 sort en préversion, avec un million de tokens de contexte.
31 juillet 2026L'éditeur publie DeepSeek-V4-Flash-0731 et met ses poids sur Hugging Face le jour même.
Jusqu'au 5 août 2026La note de la page de tarifs annonce un doublement des prix aux heures de pointe, à venir, sans date.
6 août 2026Cette note est remplacée par l'avertissement d'une hausse générale « significative ». Le doublement horaire n'est plus mentionné.

Autrement dit, l'éditeur a troqué un engagement chiffré et circonscrit contre une alerte vague et générale. C'est un changement de nature, pas seulement de formulation.

Combien coûte l'API DeepSeek face à ses concurrents

Voici les tarifs officiels, en dollars par million de tokens, relevés à la source le 7 août 2026 sur les pages de tarifs de chaque éditeur. Les deux modèles DeepSeek partagent une fenêtre de contexte d'un million de tokens, une sortie maximale de 384 000 tokens et le mode de raisonnement activé par défaut.

Modèle (API)Entrée hors cacheEntrée en cacheSortie
Qwen3.7 Flash (Alibaba)0,03 $0,13 $
DeepSeek V4 Flash0,14 $0,0028 $0,28 $
GPT-5.6 Luna (OpenAI)0,20 $0,02 $1,20 $
DeepSeek V4 Pro0,435 $0,003625 $0,87 $
Claude Haiku 4.5 (Anthropic)1,00 $0,10 $5,00 $
Gemini 3.6 Flash (Google)1,50 $0,15 $7,50 $
Claude Sonnet 5 (Anthropic)2,00 $0,20 $10,00 $
Mistral Large2,00 $6,00 $
Qwen3.7 Max (Alibaba)2,50 $7,50 $
Claude Opus 5 (Anthropic)5,00 $0,50 $25,00 $
GPT-5.6 Sol (OpenAI)5,00 $0,50 $30,00 $

Sources : documentation de l'API DeepSeek, page de tarifs de l'API OpenAI, page de tarifs Anthropic, tarifs de l'API Gemini, page de tarifs Mistral et tarifs QwenCloud. Relevés le 7 août 2026, hors taxes. Les tarifs OpenAI correspondent au palier de contexte court. Le prix de Claude Sonnet 5 est un tarif de lancement valable jusqu'au 31 août 2026, il passera ensuite à 3 $ et 15 $. La limite de concurrence est de 2500 requêtes pour V4 Flash et de 500 pour V4 Pro.

Deux enseignements sautent aux yeux. Le premier : sur l'entrée hors cache, DeepSeek n'est déjà plus le moins cher du marché. Le palier d'entrée de Qwen chez Alibaba est facturé près de cinq fois moins, à 0,03 $, même s'il se limite à 32 000 tokens par requête et vise un tout autre niveau de modèle. Le second : l'écart vraiment spectaculaire ne se joue pas sur l'entrée ni sur la sortie, mais sur les tokens déjà en cache, où DeepSeek facture 0,0028 $ le million.

À partir de quelle hausse l'avantage disparaît

C'est le calcul utile, et il ne demande qu'une division. Le tableau ci-dessous indique par combien DeepSeek V4 Flash pourrait multiplier chacun de ses tarifs avant d'arriver au niveau du concurrent.

ConcurrentEntrée hors cacheEntrée en cacheSortie
Qwen3.7 Flashdéjà moins cherdéjà moins cher
GPT-5.6 Luna× 1,4× 7× 4,3
Claude Haiku 4.5× 7× 36× 18
Gemini 3.6 Flash× 11× 54× 27
Claude Sonnet 5× 14× 71× 36
Mistral Large× 14× 21
Claude Opus 5× 36× 179× 89
GPT-5.6 Sol× 36× 179× 107

Calculs OIA à partir des tarifs officiels relevés le 7 août 2026. Un rapport de × 7 signifie que DeepSeek devrait multiplier ce tarif par sept pour cesser d'être moins cher que ce concurrent sur cette ligne.

La lecture est nette. Face au haut de gamme occidental, la marge de manœuvre est énorme : DeepSeek peut multiplier tous ses tarifs par trente-six et rester sous Claude Opus 5 ou GPT-5.6 Sol. Face au bas de gamme, c'est une autre histoire. Une hausse de 43 % sur l'entrée hors cache suffirait à faire passer V4 Flash au-dessus de GPT-5.6 Luna, le modèle bon marché d'OpenAI. Sur la sortie, la marge tombe à un facteur 4,3.

Reste la ligne qui décide vraiment de la facture d'un agent : le cache. Sur un usage agentique, la même consigne, le même contexte et les mêmes fichiers sont relus à chaque tour, et les tokens en cache dominent largement la consommation. C'est exactement ce qu'ont relevé plusieurs développeurs dans le fil Hacker News du 6 août, où l'hypothèse d'une hausse portant d'abord sur le prix de lecture du cache revient à plusieurs reprises. Là, DeepSeek dispose d'un coussin de × 7 face à GPT-5.6 Luna et de × 71 face à Claude Sonnet 5.

!
Ne confondez pas deux façons de compter

Le prix au token ne dit pas le prix d'une tâche. Un modèle bon marché qui raisonne beaucoup peut coûter plus cher qu'un modèle onéreux et concis. Notre comparatif Qwen contre DeepSeek reprend le coût par tâche mesuré par Artificial Analysis, qui est la mesure honnête. Les rapports ci-dessus portent uniquement sur le prix affiché du token.

Pourquoi DeepSeek augmente-t-il ses prix ?

L'éditeur ne le dit pas. Il faut l'écrire clairement, parce que beaucoup de reprises attribuent la hausse au coût du calcul comme s'il s'agissait d'une déclaration : la note officielle n'avance aucune cause, aucun pourcentage et aucune date. Au 7 août, nous n'avons trouvé ni billet de blog ni publication du compte officiel @deepseek_ai pour l'accompagner. L'avertissement n'existe qu'à deux endroits, la documentation et le tableau de bord des développeurs.

Ce qui est documenté, c'est le contexte. Le South China Morning Post relie la note à la demande mondiale pour DeepSeek-V4-Flash-0731, sorti une semaine plus tôt. Plusieurs développeurs signalent par ailleurs, dans le fil Hacker News du 6 août, des lenteurs inhabituelles sur l'API les jours précédents. Un développeur de l'agent de code OpenCode y a apporté le contre-pied le plus repris de la journée.

𝕏dax (@thdxr) · 6 août 2026 · traduit de l'anglais
à propos de la hausse de prix qui arrive chez deepseek nous sommes parvenus à reproduire leurs prix actuels même sur des GPU loués donc ce n'est probablement pas parce qu'ils « perdent de l'argent », c'est du lissage de trafic parce qu'ils sont surchargés
Voir le post sur X

Cette lecture recoupe la note supprimée le 6 août : une tarification à heures pleines et heures creuses ne sert pas à gagner de l'argent, elle sert à déplacer la charge. Reste que l'éditeur a remplacé cet outil de lissage par une hausse générale, ce qui va au-delà de la seule gestion de capacité.

𝕏Rohan Paul (@rohanpaul_ai) · 6 août 2026 · traduit de l'anglais
DeepSeek a officiellement annoncé que les tarifs de son API allaient augmenter « significativement » Autrement dit, le modèle proche de la frontière le moins cher du marché, à environ 3 centimes la tâche, va coûter bien plus cher. Cela tombe une semaine après la sortie de DeepSeek-V4-Flash-0731. Il se classe actuellement 2ᵉ des modèles à poids ouverts, derrière le seul Kimi K3 de Moonshot AI et ses 2 800 milliards de paramètres. Les tarifs du jour sont de 14 centimes et 28 centimes par million de tokens en entrée et en sortie, soit environ 105 fois moins cher par tâche que Claude Fable 5. Puis la demande a fait céder l'équilibre. Le nouveau point de contrôle est devenu le modèle à la croissance la plus rapide jamais vue en volume de tokens sur Ollama, qui ajoute désormais de la capacité aux États-Unis et en Europe. Servir un tel trafic à un prix conçu pour prouver quelque chose cesse de fonctionner une fois que tout le monde l'a admis. Mais le calendrier de cette hausse attire les ennuis, car Muse Spark de Meta et GPT-5.6 Luna d'OpenAI l'égalent désormais à la fois en capacité et en prix.
Voir le post sur X

Une précision s'impose sur ce dernier message : le classement des modèles à poids ouverts qu'il cite est une lecture d'auteur, pas une position officielle. Notre analyse de Qwen3.8-Max montre que le haut de ce classement bouge de semaine en semaine.

Que faire d'ici l'annonce officielle

Le point que la presse anglophone n'aborde pas est aussi celui qui limite le pouvoir de DeepSeek sur ses propres prix : ses poids sont publiés sous licence MIT. Une hausse de l'API officielle n'oblige personne à quitter le modèle, seulement à quitter le fournisseur. Vingt-deux hébergeurs tiers servent déjà DeepSeek-V4-Flash-0731 en plus de l'éditeur, et leurs tarifs sont publics.

Fournisseur du même modèleEntrée hors cacheEntrée en cacheSortie
DeepSeek (officiel)0,14 $0,0028 $0,28 $
DeepInfra0,09 $0,018 $0,18 $
AkashML0,14 $0,02 $0,28 $
Fireworks0,14 $0,028 $0,28 $
Together0,14 $0,03 $0,28 $
CoreWeave0,13 $0,07 $0,28 $

Source : API publique d'OpenRouter, endpoints du modèle `deepseek/deepseek-v4-flash-0731`, relevés le 7 août 2026. Hors taxes, en dollars par million de tokens.

Ce tableau dit deux choses. Sur les tokens neufs, un concurrent facture déjà moins cher que DeepSeek lui-même (0,09 $ contre 0,14 $ en entrée). Mais sur les tokens en cache, personne n'approche l'éditeur : le deuxième moins cher demande sept fois son tarif, et la plupart dix fois. Le vrai monopole de DeepSeek tient sur cette seule ligne, et c'est celle qui pèse le plus lourd dans une facture d'agent.

Astuce

Ouvrez votre relevé de consommation et regardez la part des tokens en cache. Si elle dépasse 80 %, votre facture dépend presque entièrement d'une ligne où DeepSeek n'a aucun équivalent, et un basculement vers un autre hébergeur du même modèle vous coûterait plus cher, pas moins. Si elle est faible, un agrégateur comme OpenRouter vous permet de changer de fournisseur sans changer de code.

Pour le grand public, rien ne change : l'application DeepSeek reste gratuite et sans limite de requêtes, comme le rappelle notre fiche DeepSeek. Seuls les développeurs qui appellent l'API sont concernés. Et si vous hésitez encore entre l'outsider chinois et la référence américaine, notre comparatif DeepSeek contre ChatGPT reprend le dossier critère par critère.

Questions fréquentes

Quel est le prix de l'API DeepSeek aujourd'hui ?

Au 7 août 2026, DeepSeek V4 Flash est facturé 0,14 $ le million de tokens en entrée hors cache, 0,0028 $ en cache et 0,28 $ en sortie. V4 Pro passe à 0,435 $, 0,003625 $ et 0,87 $.

De combien DeepSeek va-t-il augmenter ses prix ?

L'éditeur ne l'a pas dit. Sa note parle d'une hausse « significative » de la tarification globale, sans pourcentage ni date, et précise que le plan tarifaire précis fera l'objet d'une notification officielle.

Pourquoi DeepSeek augmente-t-il ses prix ?

Aucune raison officielle n'a été donnée. Le contexte documenté est une forte demande sur le modèle V4-Flash-0731 sorti le 31 juillet, des lenteurs signalées par les développeurs sur l'API, et une note précédente qui annonçait un doublement des prix aux heures de pointe.

DeepSeek restera-t-il le moins cher après la hausse ?

Cela dépend du poste. Il faudrait multiplier son tarif d'entrée par 1,4 pour dépasser GPT-5.6 Luna, mais par 36 pour dépasser Claude Opus 5 ou GPT-5.6 Sol. Sur les tokens en cache, sa marge va de 7 à 179 selon le concurrent.

Puis-je utiliser l'API DeepSeek gratuitement ?

Non, l'API officielle est facturée à l'usage dès le premier token. L'application web et mobile, elle, est gratuite et sans limite de requêtes.

Existe-t-il une alternative si les prix montent trop ?

Oui, car les poids de DeepSeek sont publiés sous licence MIT. Vingt-deux hébergeurs tiers servent déjà V4-Flash-0731, accessibles via un agrégateur comme OpenRouter, et l'auto-hébergement reste possible pour qui dispose du matériel.