DeepSeek V4-Pro augmente ses prix API le 16 août

DeepSeek V4-Pro en péage de gare bloquant une file de développeurs pressés

DeepSeek V4-Pro a reçu une nouvelle build le 13 août, et sa grille tarifaire change le 16 août à 16h00 UTC. Le prix des tokens en sortie passe de 0,87 $ à 1,98 $ le million en heures creuses et à 3,96 $ en heures pleines, avec des hausses qui atteignent plus de 1 100 % sur certains postes.

Pour résumer

  • La build DeepSeek V4-Pro 0813 monte de 45 à 53 sur l’Intelligence Index d’Artificial Analysis et reste derrière Claude Opus 5 à 63
  • La grille bascule en heures pleines et heures creuses le 16 août à 16h00 UTC, avec les hausses les plus fortes sur le cache
  • DeepSeek ouvre en parallèle son logiciel d’agent, Harness v0.1, sous licence MIT

Faire résumer cet article par une IA

ChatGPT

Un modèle refait et une grille tarifaire refaite le même jour

DeepSeek a sorti deux annonces au même moment, et la seconde annule une partie de l’attrait de la première. La build V4-Pro-0813 améliore nettement le modèle, et la note publiée avec elle acte une hausse de prix qui prend effet trois jours plus tard.

Les gains sont réels. Terminal Bench 2.1 monte de 72,1 à 87,9. DeepSWE fait un bond de 12,8 à 62,7, ce qui traduit moins une progression qu’un rattrapage sur une catégorie où le modèle ne comptait pas. L’Intelligence Index d’Artificial Analysis passe de 45 à 53, à égalité avec GLM-5.2.

Le plafond reste visible. À 53 points, DeepSeek V4-Pro se tient encore à dix points de Claude Opus 5, qui pointe à 63. La fenêtre de contexte reste à un million de tokens, et le modèle gagne le support natif de l’API Responses d’OpenAI ainsi qu’une intégration avec Codex.

La hausse était attendue sans être chiffrée. Nous avions signalé début août que les prix DeepSeek allaient grimper pour les développeurs, sans ampleur ni date communiquées à ce moment. Les deux manques ont été comblés d’un coup, dans la note de disponibilité générale publiée avec le modèle.

Le contraste avec le positionnement du printemps est net. Il y a deux semaines encore, DeepSeek V4 Flash talonnait GPT-5.6 Luna à 60 % moins cher. Cet argument de prix vient d’être rangé dans un tiroir pour toute la gamme.

La lecture la plus honnête du bond DeepSWE tient en une phrase. Un modèle qui passe de 12,8 à 62,7 sur une suite de résolution de tickets franchit le seuil de l’utilisable. Le changement porte sur la catégorie d’usage plutôt que sur une marge de progrès, et c’est précisément ce qui rend la nouvelle grille tarifaire plus douloureuse pour ceux qui allaient l’adopter.


DeepSeek V4-Pro

Ce que la grille heures pleines impose aux équipes

Le changement structurel porte moins sur le niveau des prix que sur leur variabilité dans la journée. DeepSeek introduit deux fenêtres d’heures pleines, de 1h à 4h et de 6h à 10h UTC, où le tarif double par rapport au reste du temps.

En heures creuses, l’entrée passe de 0,435 $ à 0,66 $ le million de tokens, et la sortie de 0,87 $ à 1,98 $. En heures pleines, l’entrée monte à 1,32 $ et la sortie à 3,96 $. Une même requête coûte donc jusqu’à quatre fois et demie le prix d’hier selon l’heure à laquelle elle part.

Cette grille arrive dans un contexte matériel tendu. Nous détaillions en juillet comment DeepSeek prépare sa propre puce IA pour sortir de Nvidia. Facturer l’heure de pointe deux fois plus cher revient à gérer une pénurie de calcul par le prix.

Le poste qui bouge le plus violemment est le cache. Un cache hit était facturé 0,003625 $ le million, il passera à 0,022 $ en heures creuses et 0,044 $ en heures pleines. La remise sur cache tombe de un cent-vingtième à un trentième du prix d’entrée normal.

Ce détail est le vrai piège de la migration. Les architectures qui rejouent un long préfixe commun à chaque appel, typiquement les agents avec un gros prompt système, étaient celles qui profitaient le plus de la remise. Ce sont elles qui encaissent la multiplication par douze.

Deux stratégies de contournement se dessinent déjà. Décaler les traitements par lots hors des deux fenêtres pleines devient rentable, puisque le tarif creux couvre vingt heures sur vingt-quatre. Réduire la taille du contexte réinjecté à chaque tour devient l’autre levier, maintenant que le cache ne l’absorbe plus.

Les équipes passées par la migration de juillet connaissent le rythme. DeepSeek avait déjà imposé un calendrier serré quand V4 a remplacé les anciens noms de modèles le 24 juillet. Trois jours de préavis pour une refonte tarifaire s’inscrivent dans la même façon de faire.

DeepSeek ouvre en parallèle Harness v0.1, son logiciel d’agent, sous licence MIT et en developer preview. Il repose sur le système de plugins Cordis, avec des composants interchangeables. Le geste open source arrive au moment exact où l’API devient plus chère, ce qui ressemble peu à une coïncidence de calendrier.


D’autres articles sur Horizon


Le low cost chinois arrête de subventionner

Pendant deux ans, la stratégie chinoise sur les LLM tenait en une ligne : des capacités proches des américaines, à une fraction du prix. Cette annonce ferme la seconde moitié de la proposition.

La cause probable est industrielle avant d’être commerciale. Servir un modèle de cette taille coûte cher en calcul, et une grille horaire ressemble d’abord à un outil de lissage de charge sur des GPU saturés. Le tarif devient un moyen de déplacer la demande, plus qu’un simple ajustement de marge.

Pour les concurrents chinois, la fenêtre est ouverte. Kimi K3, le plus gros modèle ouvert du marché, talonne déjà les modèles américains, et l’argument du prix bas vient de changer de main sans qu’aucun d’eux ait eu à bouger.

Côté américain, l’effet est plus subtil. La pression sur les prix venait en grande partie de la comparaison avec les tarifs chinois dans les tableaux de coût des équipes. Quand cette référence remonte, la marge de manœuvre des labos américains sur leurs propres grilles s’élargit d’autant.

Reste la question de fond, que la note tarifaire pose sans y répondre. Si le tarif d’appel chinois n’était pas soutenable à l’échelle, alors la vraie comparaison entre labos ne portait pas sur le prix affiché ces deux dernières années. Elle portait sur la capacité à tenir ce prix, et cette capacité vient de montrer sa limite.

Affaire à suivre sur Horizon.

Comments

No comments yet. Why don’t you start the discussion?

    Laisser un commentaire

    Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *