DeepSeek heeft ontwikkelaars donderdag gewaarschuwd voor een forse prijsverhoging van zijn API‑diensten – een koerswijziging voor een bedrijf dat tot nu toe slechts $0,14 per miljoen inputtokens rekende.
Belangrijkste punten:
- DeepSeek waarschuwt gebruikers voor een aanzienlijke prijsstijging van de API, maar geeft geen concrete bedragen of ingangsdatum.
- Het bedrijf rekent nu voor V4 Flash $0,14 per miljoen inputtokens en $0,28 per miljoen outputtokens – veel lager dan westerse concurrenten.
- De waarschuwing volgt op recordvraag naar V4-Flash-0731 en plannen voor een groot datacenter in Binnen-Mongolië.
Aankondiging DeepSeek API‑prijs
Het in Hangzhou gevestigde bedrijf heeft de mededeling geplaatst op zijn ontwikkelaarsplatform, zonder bedragen, procentuele wijzigingen of een ingangsdatum te noemen.
DeepSeek liet alleen weten dat de totale prijsstructuur “binnen afzienbare tijd” omhooggaat en dat nadere details later volgen. Klanten kregen het advies hun verbruik “overeenkomend te plannen”, een formulering die niets zegt over de daadwerkelijke orde van grootte.
Momenteel rekent DeepSeek voor V4 Flash $0,14 per miljoen inputtokens en $0,28 per miljoen outputtokens – tarieven die de rest van de markt met een factor tien onderbieden. Moonshot AI vraagt voor hetzelfde volume bij Kimi K3 respectievelijk $3 en $15, terwijl Anthropic voor zijn Fable 5‑dienst $10 en $50 in rekening brengt.
De waarschuwing komt een week na de introductie van V4-Flash-0731, een model met 284 miljard parameters waarvan er per verzoek circa 13 miljard worden geactiveerd. Die architectuur houdt de kosten van een gemiddelde taak rond de drie dollarcent.
Ook interessant: Airbnb-aandeel schiet 17% omhoog nu CEO zegt dat AI 45% van supportvragen zonder menselijk ingrijpen afhandelt
Ontwikkelaars zetten vraagtekens bij timing DeepSeek
AI‑ontwikkelaar Michael Guo uitte op donderdag via sociale media zijn kritiek op het moment van de aankondiging en waarschuwde dat DeepSeek “om problemen vraagt” door nu al de prijzen te verhogen.
Volgens hem hebben Amerikaanse labs veel van de voorsprong ingehaald die DeepSeek had op zowel kosten als prestaties. Meta’s Muse Spark en OpenAI’s GPT-5.6 Luna vissen inmiddels in dezelfde vijver en richten zich op precies hetzelfde ontwikkelaarsbudget.
Gebruikscijfers illustreren hoe snel de druk opliep nadat het model algemeen beschikbaar kwam. In de ranglijst van OpenRouter stond V4 Flash in de week van 27 juli tot en met 2 augustus op nummer één met 7,22 biljoen tokens, terwijl het codeerplatform OpenCode op 1 augustus alleen al 8 biljoen tokens registreerde.
DeepSeek draait aan de prijsknop
Verkeer op deze schaal vraagt om enorme hoeveelheden chips en stroom, wat met bodemprijzen maar beperkt vol te houden is. DeepSeek werkt aan een groot datacenter in Binnen‑Mongolië, onderdeel van een bredere strategie om één gigawatt aan rekenvermogen veilig te stellen voor eigen gebruik.
Topman Jensen Huang van Nvidia schatte dat een infrastructuur van die omvang, uitgerust met de nieuwste versnellers, ruwweg $50 miljard zou kosten.
De voorgenomen verhoging is de tweede prijsaanpassing in nog geen maand tijd. In juli voerde DeepSeek al piek‑ en daltariefstructuren in om de druk op de servers tijdens de drukste uren te verlichten. Die wijziging werd in de mededeling van half juli aangekondigd.
Daarvóór leidde een permanente korting op V4 in mei ertoe dat binnenlandse rivalen als ByteDance en Tencent hun eigen openbare tarieven naar beneden bijstelden.
Lees ook: Google DeepMind verliest vier topfiguren uit de beginjaren op één dag





