Tous les guides
Actualité10 min de lecture · mis à jour 18 août 2026

DeepSeek V4 Pro a été lancé, puis ses tarifs API ont bondi jusqu'à 1 100 %, et ce chiffre ne concerne pas les tokens auxquels vous pensez

DeepSeek a livré un modèle réellement plus solide le 13 août 2026, puis a fait exploser sa propre réputation de faiseur d'IA bon marché trois jours plus tard. Le titre « hausse de prix de 1 100 % » que tout le monde reprend est réel, mais il ne concerne pas les tokens de sortie que la plupart des gens imaginent. Voici ce qui a réellement changé, ce que ça coûte désormais, et si DeepSeek vaut encore le coup.

Réponse rapide

DeepSeek-V4-Pro-0813 est sorti de préversion et est passé en disponibilité générale le 13 août 2026, sous licence MIT, avec un score de 53 à l'Artificial Analysis Intelligence Index, à peu près au niveau du GLM-5.2 de Zhipu et à quelques points derrière GPT-5.6 Terra et Kimi K3.

Depuis le 16 août 2026, 16h00 UTC, DeepSeek a remplacé sa tarification API fixe par des tarifs heures pleines et heures creuses. Les tokens de sortie ont augmenté de 355 à 371 %. Le chiffre bien plus alarmant de « jusqu'à 1 100 % » que tout le monde cite concerne spécifiquement les tokens d'entrée mis en cache, passés d'un tarif étonnamment bas de 0,0036 $/million à jusqu'à 0,044 $/million en heures pleines.

L'application de chat web et mobile gratuite de DeepSeek n'est pas concernée. C'est un changement de prix uniquement lié à l'API, qui vise les développeurs et tous ceux qui construisent au-dessus du modèle.

Même après la hausse, DeepSeek reste moins cher que les modèles phares occidentaux, simplement plus dans les proportions de 10 à 30 fois qu'auparavant. Le prix de sortie en heures pleines de V4-Pro (3,96 $/million) représente environ un quart de celui de Claude Opus 5 (25 $/million) et environ un huitième de celui de GPT-5.6 Sol (30 $/million).

Ce qui a réellement été déployé le 13 août

DeepSeek-V4-Pro-0813 est sorti d'une préversion d'avril 2026 pour atteindre la disponibilité générale le 13 août, accessible via le site web de DeepSeek, son application mobile et son API, avec des poids publiés sous licence MIT sur Hugging Face. Le propre tableau de benchmarks de DeepSeek montre de larges bonds par rapport à la version de préversion : Terminal-Bench passant de 72,1 à un score revendiqué de 87,9, et SWE-bench Verified atteignant un score revendiqué de 96,40 %. Ce sont les chiffres de DeepSeek, pas des chiffres reproduits de façon indépendante, et cette distinction compte plus que d'habitude ici.

Les évaluateurs indépendants n'ont pas été tendres avec les chiffres autodéclarés. Artificial Analysis place l'Intelligence Index de V4-Pro à 53, au niveau du GLM-5.2 de Zhipu, quatre points derrière GPT-5.6 Terra et sept derrière Kimi K3, pas un score de tête de frontière. Le South China Morning Post a rapporté qu'un rejeu indépendant de Terminal-Bench atterrissait autour de 54,68 %, loin des 87,9 % revendiqués par DeepSeek, et a cité le classement Vals AI plaçant le modèle 12e sur son propre tableau, derrière le GPT-5.5 de génération précédente. Rien de tout cela ne fait de V4-Pro un mauvais modèle. Cela rend le tableau marketing de DeepSeek aussi peu fiable que celui de n'importe quel fournisseur qui note ses propres devoirs, et cela mérite le même scepticisme.

Le changement de tarification, exactement

Trois jours après le lancement de V4-Pro, à 16h00 UTC le 16 août 2026, le propre journal des modifications de DeepSeek a confirmé le passage d'une tarification fixe par token à une structure heures pleines et heures creuses. Les heures pleines sont 01h00-04h00 et 06h00-10h00 UTC, soit 9h-midi et 14h-18h heure de Pékin, sept heures par jour ; les 17 heures restantes sont en heures creuses, facturées exactement à la moitié du tarif plein. La raison invoquée par DeepSeek, dans ses propres mots, est « d'allouer les ressources plus raisonnablement » et d'encourager les développeurs à décaler leur charge de travail vers les heures plus calmes. L'entreprise avait déjà signalé une « hausse significative » à venir sur sa page de tarification vers le 6 août, donc ce n'était pas une totale surprise pour quiconque suivait le dossier de près.

Model / token type              Old (flat)    New off-peak   New peak    Peak increase
------------------------------------------------------------------------------------
V4-Pro  input, cache miss         $0.435/M       $0.66/M        $1.32/M        ~203%
V4-Pro  input, cache HIT          $0.0036/M      $0.022/M       $0.044/M      ~1,114%
V4-Pro  output                    $0.87/M        $1.98/M        $3.96/M        ~355%
V4-Flash  input, cache miss       $0.14/M        $0.22/M        $0.44/M        ~214%
V4-Flash  output                  $0.28/M        $0.66/M        $1.32/M        ~371%

Ce tableau raconte toute l'histoire, et c'est pourquoi les titres disant « les prix ont quadruplé » et ceux disant « les prix ont augmenté de 1 100 % » sont tous deux techniquement exacts, mais à propos de chiffres différents. La hausse des tokens de sortie, celle qui détermine la facture mensuelle de la plupart des gens, est un bond de 355 à 371 %, soit un multiplicateur d'environ 4 à 4,7 fois. Le chiffre spectaculaire de plus de 1 100 % concerne spécifiquement les tokens d'entrée mis en cache, un coût plus étroit et plus spécialisé : c'est ce que vous payez quand une requête réutilise un contexte que les serveurs de DeepSeek ont déjà traité, courant dans les longues sessions d'agents en va-et-vient et les flux de travail à contexte répété. Ce type de token était auparavant facturé à un prix étonnamment bas de 0,0036 $ par million, donc même une hausse importante en dollars produit un écart en pourcentage énorme. Si votre flux de travail ne repose pas fortement sur la mise en cache de prompts, vous ressentirez quelque chose de plus proche du chiffre x4 que du x12.

Page de documentation officielle de l'API DeepSeek montrant le tableau Models & Pricing pour deepseek-v4-flash et deepseek-v4-pro, avec les URL de base, les versions de modèle et la longueur de contexte
Page Models & Pricing de DeepSeek, api-docs.deepseek.com, août 2026.

Qui a réellement ressenti ça, et ce qu'ils en ont dit

La décomposition la plus claire du changement circulant parmi les développeurs vient d'un fil Hacker News discutant de l'annonce de DeepSeek elle-même. Un commentaire largement plébiscité l'a dit simplement : « la hausse en pourcentage à quatre chiffres vient de l'entrée mise en cache, qui était tarifée à un niveau étonnamment bas de 0,003625 $ par million de tokens... Même après la hausse, DeepSeek reste bon marché par rapport aux grands modèles de pointe... aux tarifs pleins, DeepSeek V4-Pro coûte encore environ les deux tiers de Sonnet en entrée et environ 40 % en sortie. » Un autre développeur a reconnu que même avant la hausse, la friction de maintenir une configuration basée sur DeepSeek n'en valait pas clairement la peine une fois qu'un abonnement Claude était déjà payé : « J'ai essayé de rester sur une configuration DeepSeek + OpenCode toute la semaine, mais on dirait que mon Claude Max subventionné reste tout de même assez pertinent. »

Un troisième point de ce même fil est facile à manquer et réellement utile si vous hésitez à changer de fournisseur pour cette seule raison : le prix brut par token en dit moins qu'il n'y paraît, car il ignore à quel point la mise en cache d'un fournisseur fonctionne réellement et combien de tokens un modèle donné consomme pour terminer la même tâche. Un prix affiché plus bas sur un modèle qui a besoin de deux fois plus de tokens pour résoudre un problème n'est pas vraiment moins cher. Certains développeurs du même fil ont rapporté des factures mensuelles passant d'environ 5 $ à 15 $ sous la nouvelle structure, et ont noté que les heures pleines de DeepSeek correspondent à la journée de travail principale en Chine, ce qui désavantage structurellement les développeurs américains et européens qui ne peuvent pas facilement décaler leurs charges lourdes vers la fenêtre creuse de DeepSeek sans travailler eux-mêmes à des heures inhabituelles.

Comment DeepSeek se compare désormais

Le cadrage honnête : DeepSeek n'a pas cessé d'être bon marché, il a cessé d'être absurdement bon marché. Aux tarifs pleins, le taux de sortie de V4-Pro à 3,96 $ par million de tokens reste une fraction de ce que facturent les modèles phares occidentaux.

Model                                  Input $/M      Output $/M
--------------------------------------------------------------
DeepSeek V4-Pro (off-peak)               $0.66          $1.98
DeepSeek V4-Pro (peak)                   $1.32          $3.96
DeepSeek V4-Flash (peak)                 $0.44          $1.32
Claude Sonnet 5                          $2.00          $10.00
Claude Opus 5                            $5.00          $25.00
Claude Fable 5                          $10.00          $50.00
GPT-5.6 Luna                            ~$0.20          ~$1.20
GPT-5.6 Terra                            $2.00          $12.00
GPT-5.6 Sol                              $5.00          $30.00
Gemini 3.7 Flash (intro, through 2026)   $0.75           $3.75

V4-Pro en heures pleines reste toujours en dessous de Claude Sonnet 5 sur le prix de sortie, et se situe à environ un quart du tarif d'Opus 5 et un huitième de celui de GPT-5.6 Sol. L'écart qui comptait pour les développeurs sensibles au prix il y a un mois, DeepSeek étant 10 à 30 fois moins cher qu'un modèle phare occidental, s'est resserré à quelque chose de plus proche de 4 à 8 fois. C'est encore un avantage réel. Simplement, ce n'est plus le genre d'avantage qui fait du prix, à lui seul, tout l'argument de vente, surtout face à GPT-5.6 Luna, qu'OpenAI a réduit de 80 % le 30 juillet et qui bat désormais même DeepSeek V4-Flash en heures creuses sur le prix de sortie.

Ce que cela signifie si vous construisez réellement quelque chose

  • Utilisateurs du chat web/app gratuit : rien ne change. Ce changement de prix ne concerne que l'API. Si vous utilisez simplement deepseek.com ou l'application mobile pour discuter, votre accès n'est pas affecté.
  • Charges par lots ou non interactives : décalez ce que vous pouvez vers les 17 heures creuses (01h00-04h00 et 06h00-10h00 UTC) pour conserver à peu près l'ancien multiplicateur x2 plutôt que les nouveaux tarifs pleins.
  • Les flux de travail d'agents lourds en cache (sessions longues qui réutilisent le contexte de façon répétée) sont les plus durement touchés en termes relatifs, car c'est exactement le type de token qui a bondi d'environ x12 en heures pleines. Budgétisez en conséquence ou réévaluez si la charge doit vraiment tourner aux heures pleines.
  • Avant de changer de fournisseur pour cette seule raison, chiffrez une charge de travail réelle de bout en bout, pas seulement le tarif par token. Un modèle qui nécessite plus de tokens ou plus de tentatives pour finir le même travail peut effacer rapidement un prix affiché plus bas, un point que le fil Hacker News ci-dessus souligne directement.

Pour les lecteurs de ce site dont le vrai travail consiste à lire et résumer des documents plutôt qu'à construire des pipelines d'agents, cette nouvelle est plus intéressante que directement pertinente. Gemini Notebook n'est pas du tout facturé par token API ; c'est un abonnement forfaitaire (gratuit, ou 4,99-199,99 $/mois selon le palier) avec des limites de sources et de requêtes plutôt qu'une facture au compteur, ce qui est un modèle de coût réellement différent de tout ce qu'on voit dans le tableau ci-dessus. Si vous évaluez les outils d'IA en général plutôt que de spécifiquement chercher l'API la moins chère, notre comparatif des alternatives à Gemini Notebook montre où DeepSeek et les autres se situent vraiment.

DeepSeek reste-t-il moins cher que ChatGPT, Claude et Gemini ?

Oui, mais avec une marge plus faible qu'avant. Aux tarifs API pleins, le prix de sortie de DeepSeek V4-Pro (3,96 $/million de tokens) reste environ un quart de celui de Claude Opus 5 et un huitième de celui de GPT-5.6 Sol, contre l'écart de 10 à 30 fois que DeepSeek avait auparavant. En heures creuses, l'écart se rapproche à nouveau des anciennes marges.

La hausse de prix affecte-t-elle l'application de chat gratuite de DeepSeek ?

Non. Le changement de tarification du 16 août 2026 ne s'applique qu'à l'API, l'interface que les développeurs utilisent pour construire au-dessus du modèle. Le site web gratuit et l'application mobile de chat de DeepSeek ne sont pas affectés.

Pourquoi le prix a-t-il augmenté de 1 100 % pour certains chiffres mais pas d'autres ?

Le chiffre de plus de 1 100 % s'applique spécifiquement aux tokens d'entrée mis en cache, qui étaient tarifés à un niveau étonnamment bas avant le changement (0,0036 $/million) et ont grimpé jusqu'à 0,044 $/million en heures pleines, soit une hausse d'environ 12 fois en valeur, même si le coût absolu reste faible. Les tokens de sortie, qui déterminent la facture réelle de la plupart des gens, ont augmenté d'un chiffre séparé et plus modeste de 355 à 371 %.

DeepSeek V4 Pro est-il réellement un meilleur modèle que la version précédente ?

Les propres benchmarks publiés par DeepSeek montrent de larges gains, mais les tests indépendants ne les ont pas confirmés. Le South China Morning Post a rapporté qu'un rejeu indépendant de Terminal-Bench a obtenu un score d'environ 54,68 % contre les 87,9 % revendiqués par DeepSeek, et le classement de Vals AI placerait le modèle 12e, derrière le GPT-5.5 de génération précédente. Considérez les propres chiffres de DeepSeek comme un point de départ, pas un fait établi.

Continuer la lecture