DeepSeek met fin à son tarif choc de 0,14 $ avec un avertissement majeur sur les prix

A significant API price rise is coming from DeepSeek, whose V4 Flash model charges $0.14 per million input tokens today. (Image: Shutterstock)
A significant API price rise is coming from DeepSeek, whose V4 Flash model charges $0.14 per million input tokens today. (Image: Shutterstock)

DeepSeek a averti jeudi les développeurs d’une forte hausse prochaine de ses tarifs API, un revirement pour une société qui s’était fait remarquer en facturant 0,14 $ par million de tokens d’entrée.

Points clés :

  • DeepSeek a prévenu ses utilisateurs d’une hausse significative des prix de l’API, sans préciser ni les montants ni la date d’entrée en vigueur.
  • Le groupe pratique aujourd’hui des tarifs largement inférieurs à ceux des acteurs occidentaux, à 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash.
  • L’alerte intervient après un pic de demande record pour V4-Flash-0731 et l’annonce d’un vaste projet de data center en Mongolie intérieure.

Avertissement sur les tarifs de l’API DeepSeek

La société basée à Hangzhou a publié cet avertissement sur sa plateforme développeurs, sans donner ni chiffres, ni pourcentages, ni calendrier précis.

Elle s’est contentée d’indiquer qu’une hausse générale des prix interviendrait « dans un avenir proche », les détails étant communiqués ultérieurement. Les clients ont été invités à « planifier leur usage en conséquence », une formule qui ne dit rien de l’ampleur réelle du relèvement.

DeepSeek facture aujourd’hui 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash, des niveaux qui cassent littéralement le marché, avec un écart d’un ordre de grandeur par rapport à la plupart des concurrents. Moonshot AI demande 3 $ et 15 $ pour les mêmes volumes sur Kimi K3, tandis qu’Anthropic affiche 10 $ et 50 $ pour des prestations équivalentes sur son service Fable 5.

L’avertissement intervient une semaine après le lancement de V4-Flash-0731, un modèle de 284 milliards de paramètres, dont environ 13 milliards seulement sont activés simultanément. Cette architecture permet de maintenir le coût d’une tâche type aux alentours de trois centimes de dollar.

À lire aussi : L’action Airbnb bondit de 17 % alors que le PDG affirme que l’IA résout 45 % des demandes de support sans intervention humaine

Les développeurs s’interrogent sur le timing de DeepSeek

Le développeur IA Michael Guo a critiqué le calendrier de l’annonce dans un post sur les réseaux sociaux jeudi, estimant que le groupe « se cherche des problèmes » en bougeant maintenant.

Il rappelle que les laboratoires américains ont largement comblé l’avance dont bénéficiait DeepSeek, tant en matière de coûts que de performances. Meta avec Muse Spark et OpenAI avec GPT-5.6 Luna se positionnent désormais frontalement sur les mêmes budgets développeurs.

Les chiffres d’usage témoignent de la vitesse à laquelle la pression est montée après la mise à disposition générale du modèle. Les classements d’OpenRouter ont placé V4 Flash en tête la semaine du 27 juillet au 2 août avec 7,22 billions de tokens, tandis que la plateforme de développement OpenCode a enregistré 8 billions de tokens en une seule journée, le 1er août.

DeepSeek rebat les cartes de sa politique tarifaire

Servir un tel volume de requêtes consomme des quantités de puces et d’électricité que des prix « au rabais » ne peuvent couvrir longtemps. DeepSeek prévoit un vaste data center en Mongolie intérieure, dans le cadre d’un plan visant à sécuriser pour son propre usage une capacité de calcul d’un gigawatt.

Le directeur général de Nvidia, Jensen Huang, évalue le coût d’une telle infrastructure à environ 50 milliards de dollars, si elle est équipée des accélérateurs les plus avancés.

Cette augmentation constituera le deuxième ajustement tarifaire de DeepSeek en moins d’un mois, après l’introduction mi-juillet de grilles « heures pleines / heures creuses » destinée à soulager ses serveurs aux périodes de pointe.

Auparavant, une remise permanente sur V4 annoncée en mai avait contraint des rivaux chinois comme ByteDance et Tencent à réduire, eux aussi, leurs tarifs publics.

À suivre : Google DeepMind perd quatre figures historiques de son ère fondatrice en une seule journée

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com et couvre l’actualité crypto depuis dix ans. Il est spécialisé dans les articles de Recherche et Learn approfondis, avec un accent particulier sur l’analyse, la mise en contexte sectorielle et les grandes forces qui façonnent l’écosystème crypto, de l’ère de l’IA et des technologies de sécurité aux innovations fintech. Il est convaincu que tout ce qui est numérique supplantera très prochainement tout ce qui est analogique et travaille dur pour contribuer à rendre cela possible.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
Dernières nouvelles
Voir toutes les nouvelles