DeepSeek a averti jeudi les développeurs d’une forte hausse prochaine de ses tarifs API, un revirement pour une société qui s’était fait remarquer en facturant 0,14 $ par million de tokens d’entrée.
Points clés :
- DeepSeek a prévenu ses utilisateurs d’une hausse significative des prix de l’API, sans préciser ni les montants ni la date d’entrée en vigueur.
- Le groupe pratique aujourd’hui des tarifs largement inférieurs à ceux des acteurs occidentaux, à 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash.
- L’alerte intervient après un pic de demande record pour V4-Flash-0731 et l’annonce d’un vaste projet de data center en Mongolie intérieure.
Avertissement sur les tarifs de l’API DeepSeek
La société basée à Hangzhou a publié cet avertissement sur sa plateforme développeurs, sans donner ni chiffres, ni pourcentages, ni calendrier précis.
Elle s’est contentée d’indiquer qu’une hausse générale des prix interviendrait « dans un avenir proche », les détails étant communiqués ultérieurement. Les clients ont été invités à « planifier leur usage en conséquence », une formule qui ne dit rien de l’ampleur réelle du relèvement.
DeepSeek facture aujourd’hui 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash, des niveaux qui cassent littéralement le marché, avec un écart d’un ordre de grandeur par rapport à la plupart des concurrents. Moonshot AI demande 3 $ et 15 $ pour les mêmes volumes sur Kimi K3, tandis qu’Anthropic affiche 10 $ et 50 $ pour des prestations équivalentes sur son service Fable 5.
L’avertissement intervient une semaine après le lancement de V4-Flash-0731, un modèle de 284 milliards de paramètres, dont environ 13 milliards seulement sont activés simultanément. Cette architecture permet de maintenir le coût d’une tâche type aux alentours de trois centimes de dollar.
À lire aussi : L’action Airbnb bondit de 17 % alors que le PDG affirme que l’IA résout 45 % des demandes de support sans intervention humaine
Les développeurs s’interrogent sur le timing de DeepSeek
Le développeur IA Michael Guo a critiqué le calendrier de l’annonce dans un post sur les réseaux sociaux jeudi, estimant que le groupe « se cherche des problèmes » en bougeant maintenant.
Il rappelle que les laboratoires américains ont largement comblé l’avance dont bénéficiait DeepSeek, tant en matière de coûts que de performances. Meta avec Muse Spark et OpenAI avec GPT-5.6 Luna se positionnent désormais frontalement sur les mêmes budgets développeurs.
Les chiffres d’usage témoignent de la vitesse à laquelle la pression est montée après la mise à disposition générale du modèle. Les classements d’OpenRouter ont placé V4 Flash en tête la semaine du 27 juillet au 2 août avec 7,22 billions de tokens, tandis que la plateforme de développement OpenCode a enregistré 8 billions de tokens en une seule journée, le 1er août.
DeepSeek rebat les cartes de sa politique tarifaire
Servir un tel volume de requêtes consomme des quantités de puces et d’électricité que des prix « au rabais » ne peuvent couvrir longtemps. DeepSeek prévoit un vaste data center en Mongolie intérieure, dans le cadre d’un plan visant à sécuriser pour son propre usage une capacité de calcul d’un gigawatt.
Le directeur général de Nvidia, Jensen Huang, évalue le coût d’une telle infrastructure à environ 50 milliards de dollars, si elle est équipée des accélérateurs les plus avancés.
Cette augmentation constituera le deuxième ajustement tarifaire de DeepSeek en moins d’un mois, après l’introduction mi-juillet de grilles « heures pleines / heures creuses » destinée à soulager ses serveurs aux périodes de pointe.
Auparavant, une remise permanente sur V4 annoncée en mai avait contraint des rivaux chinois comme ByteDance et Tencent à réduire, eux aussi, leurs tarifs publics.
À suivre : Google DeepMind perd quatre figures historiques de son ère fondatrice en une seule journée





