DeepSeek a averti jeudi les développeurs d’une hausse « significative » de l’ensemble de ses tarifs API, un revirement pour un acteur qui ne facture aujourd’hui que 0,14 $ par million de tokens d’entrée.
À retenir :
- DeepSeek a prévenu ses utilisateurs d’une forte hausse à venir des prix de son API, sans préciser ni montants ni date d’entrée en vigueur.
- Le groupe pratique actuellement des prix nettement inférieurs à ceux de ses concurrents occidentaux : 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash.
- L’alerte intervient après une demande record pour V4-Flash-0731 et des projets de méga‑datacenter en Mongolie intérieure.
DeepSeek annonce une révision de ses tarifs API
La société basée à Hangzhou a publié un avis sur sa plateforme développeurs, sans communiquer ni barème, ni pourcentage, ni calendrier précis pour cette hausse.
Elle s’est contentée d’indiquer que sa grille tarifaire globale augmenterait « dans un avenir proche », promettant des détails ultérieurs. Les clients ont été invités à « planifier leur consommation en conséquence », une formule qui n’éclaire en rien l’ampleur du mouvement.
DeepSeek facture aujourd’hui 0,14 $ par million de tokens d’entrée et 0,28 $ par million de tokens de sortie pour V4 Flash, des niveaux qui sous‑côtent de très loin la plupart du marché. Moonshot AI demande 3 $ et 15 $ pour les mêmes volumes sur Kimi K3, tandis qu’Anthropic affiche 10 $ et 50 $ pour des charges équivalentes sur son service Fable 5.
L’avertissement tombe une semaine après le lancement de V4-Flash-0731, un modèle de 284 milliards de paramètres qui n’en active qu’environ 13 milliards à la fois, un choix d’architecture permettant de contenir le coût moyen d’une tâche autour de trois cents de dollar.
À lire aussi : L’action Airbnb bondit de 17 % alors que le PDG affirme que l’IA résout 45 % des demandes de support sans intervention humaine
Les développeurs contestent le timing de DeepSeek
Le développeur IA Michael Guo a critiqué jeudi, sur les réseaux sociaux, le moment choisi par DeepSeek, estimant que le groupe « se créait des problèmes » en bougeant maintenant.
Il souligne que les laboratoires américains ont largement comblé l’écart dont bénéficiait autrefois DeepSeek, tant sur les coûts que sur les performances. Meta avec Muse Spark et OpenAI avec GPT‑5.6 Luna se positionnent désormais frontalement sur les mêmes budgets développeurs.
Les chiffres d’usage illustrent la rapidité de la montée en charge depuis l’ouverture générale du modèle. Les classements d’OpenRouter placent V4 Flash en tête pour la semaine du 27 juillet au 2 août, avec 7,22 billions de tokens consommés, tandis que la plateforme de développement OpenCode a enregistré 8 billions de tokens sur la seule journée du 1er août.
DeepSeek rebat les cartes de sa stratégie tarifaire
Servir un tel volume de requêtes exige des quantités massives de puces et d’électricité, difficilement compatibles dans la durée avec une politique de prix cassés. DeepSeek prévoit un vaste datacenter en Mongolie intérieure, dans le cadre d’un plan visant à sécuriser un gigawatt de puissance de calcul pour ses propres besoins.
Le directeur général de Nvidia, Jensen Huang, a estimé qu’une infrastructure de cette envergure représenterait environ 50 milliards de dollars d’investissements, si elle était équipée des accélérateurs les plus avancés.
La hausse annoncée constitue le deuxième ajustement tarifaire de DeepSeek en moins d’un mois, après l’introduction à la mi‑juillet de tarifs « heures pleines / heures creuses » destinée à soulager ses serveurs aux moments de pointe.
Auparavant, une remise permanente appliquée à V4 en mai avait poussé des concurrents chinois comme ByteDance et Tencent à revoir eux aussi leurs grilles à la baisse.
À suivre : Google DeepMind perd quatre dirigeants de la première heure en une seule journée





