DeepSeek manda in pensione l’API da 0,14 $ con un duro avvertimento sui prezzi

A significant API price rise is coming from DeepSeek, whose V4 Flash model charges $0.14 per million input tokens today. (Image: Shutterstock)
A significant API price rise is coming from DeepSeek, whose V4 Flash model charges $0.14 per million input tokens today. (Image: Shutterstock)

DeepSeek ha avvertito giovedì gli sviluppatori di un imminente, rilevante aumento dei prezzi su tutta la gamma di servizi API, una brusca inversione di rotta per un operatore che finora si distingueva per il listino ultra‑aggressivo da 0,14 dollari per milione di token in input.

Punti chiave:

  • DeepSeek ha informato gli utenti che è in arrivo un forte rincaro delle API, senza indicare né i nuovi livelli di prezzo né la data di decorrenza.
  • Oggi il gruppo pratica tariffe di gran lunga inferiori a quelle dei concorrenti occidentali: 0,14 $ per milione di token in input e 0,28 $ in output per V4 Flash.
  • L’allerta sui prezzi arriva dopo una domanda record per V4-Flash-0731 e i piani per un maxi data center in Mongolia Interna.

Avviso sui prezzi dell’API DeepSeek

La società con sede a Hangzhou ha pubblicato la comunicazione sulla propria piattaforma per sviluppatori, senza fornire né cifre né percentuali, né tantomeno una data di entrata in vigore.

Si è limitata a indicare che il livello complessivo dei prezzi salirà nel prossimo futuro, rimandando i dettagli a un secondo momento. Ai clienti è stato chiesto di “pianificare di conseguenza” i consumi, una formula che non chiarisce affatto l’ordine di grandezza del rincaro.

Attualmente DeepSeek applica 0,14 dollari per milione di token in input e 0,28 dollari in output per V4 Flash, uno sconto che, in molti casi, taglia di un ordine di grandezza le tariffe prevalenti sul mercato. Moonshot AI per il modello Kimi K3 chiede 3 e 15 dollari per gli stessi volumi, mentre Anthropic prezza a 10 e 50 dollari il medesimo carico di lavoro sul servizio Fable 5.

L’avvertimento giunge una settimana dopo il lancio di V4-Flash-0731, un modello da 284 miliardi di parametri che ne attiva circa 13 miliardi per singolo task: un’architettura pensata per contenere il costo di un’operazione tipica attorno ai tre centesimi di dollaro.

Da leggere anche: Il titolo Airbnb balza del 17%: per il CEO l’AI gestisce il 45% delle richieste di supporto senza intervento umano

Sviluppatori perplessi sulla tempistica di DeepSeek

Lo sviluppatore di AI Michael Guo ha messo in discussione la tempistica della mossa in un post sui social di giovedì, sostenendo che l’azienda rischia di complicarsi la vita scegliendo questo momento per alzare i listini.

Guo ha sottolineato come i laboratori statunitensi abbiano ridotto gran parte del vantaggio competitivo che DeepSeek aveva costruito sia sul fronte dei costi sia su quello delle prestazioni. Meta con Muse Spark e OpenAI con GPT-5.6 Luna oggi si contendono gli stessi budget degli sviluppatori che guardavano a DeepSeek.

I dati d’uso mostrano quanto rapidamente si sia accumulata pressione sull’infrastruttura dopo l’apertura generalizzata del modello. Le classifiche di OpenRouter collocano V4 Flash al primo posto nella settimana 27 luglio – 2 agosto, con 7,22 trilioni di token, mentre la piattaforma di coding OpenCode ha registrato 8 trilioni di token in un solo giorno, il 1° agosto.

La svolta nella strategia di pricing di DeepSeek

Gestire traffico su questa scala implica consumi di chip e di energia tali da rendere insostenibili, nel medio periodo, politiche di prezzo alla “svendita”. DeepSeek programma la costruzione di un grande data center in Mongolia Interna, tassello chiave di un piano per assicurarsi un gigawatt di potenza di calcolo a uso esclusivo.

L’amministratore delegato di Nvidia, Jensen Huang, ha stimato che un’infrastruttura di queste dimensioni, equipaggiata con gli acceleratori più avanzati, comporterebbe un investimento nell’ordine dei 50 miliardi di dollari.

Il rialzo annunciato rappresenta la seconda modifica del listino in meno di un mese, dopo l’introduzione – a metà luglio – di tariffe differenziate tra ore di picco e fasce non di punta, pensate per alleggerire il carico sui server nei momenti di maggiore congestione.

In precedenza, uno sconto permanente su V4, annunciato a maggio, aveva spinto rivali domestici come ByteDance e Tencent a ritoccare al ribasso i rispettivi prezzi ufficiali.

Da vedere anche: Google DeepMind perde in un solo giorno quattro leader della prima ora

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev è il Responsabile dei Contenuti di Yellow.com e si occupa di criptovalute da 10 anni. È specializzato in articoli di Ricerca e Approfondimento, con un’attenzione particolare all’analisi, al contesto del settore e alle grandi forze che stanno plasmando il mondo crypto, dall’era dell’IA e le tecnologie di sicurezza fino all’innovazione fintech. È convinto che tutto ciò che è digitale supererà presto tutto ciò che è analogico e lavora duramente per contribuire a realizzare questa visione.

Disclaimer e avvertenza sui rischi: Le informazioni fornite in questo articolo sono solo per scopi educativi e informativi e sono basate sull'opinione dell'autore. Non costituiscono consulenza finanziaria, di investimento, legale o fiscale. Gli asset di criptovaluta sono altamente volatili e soggetti ad alto rischio, incluso il rischio di perdere tutto o una parte sostanziale del tuo investimento. Il trading o il possesso di asset crypto potrebbe non essere adatto a tutti gli investitori. Le opinioni espresse in questo articolo sono esclusivamente quelle dell'autore/autori e non rappresentano la politica ufficiale o la posizione di Yellow, dei suoi fondatori o dei suoi dirigenti. Conduci sempre la tua ricerca approfondita (D.Y.O.R.) e consulta un professionista finanziario autorizzato prima di prendere qualsiasi decisione di investimento.
DeepSeek manda in pensione l’API da 0,14 $ con un duro avvertimento sui prezzi | Yellow