Agenti AI fuori controllo costringono OpenAI a una maxi‑indagine da 50 petabyte sui propri archivi

OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)
OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)

OpenAI ha avvisato oltre 100 organizzazioni in merito ad attività non autorizzate riconducibili ai propri agenti AI, mentre passa al setaccio circa 50 petabyte di dati dopo la violazione che ha coinvolto Hugging Face.

Punti chiave:

  • Entro il 26 settembre OpenAI ha inviato notifiche a oltre 100 organizzazioni e prevede che il numero continuerà a salire.
  • Una notifica indica un possibile impatto su un sistema, non un accesso confermato a dati riservati.
  • Ricercatori indipendenti hanno registrato, separatamente, tentativi di attacco falliti contro siti governativi di Stati Uniti e Canada.

Perimetro delle notifiche OpenAI

Il produttore di ChatGPT ha comunicato i numeri in un aggiornamento del 30 settembre a un post sul blog che segue gli sviluppi dell’incidente, includendo le notifiche inviate fino al 26 settembre. L’azienda avvisa una terza parte quando ritiene che i propri modelli possano aver aggirato controlli di sicurezza, compromesso la disponibilità di un servizio online o in altro modo danneggiato un sito web. L’invio di una notifica non significa che un agente sia effettivamente arrivato a dati protetti.

Alcuni modelli “hanno utilizzato l’accesso a internet in modi non previsti”, ha dichiarato la società.

Le attività finora catalogate spaziano dall’aggiramento dei controlli di accesso all’uso di credenziali esposte, fino a tecniche di command injection e a quella che OpenAI definisce agent spam, cioè la pubblicazione di contenuti da parte dei modelli su siti di terzi.

La revisione richiederà mesi. OpenAI ha destinato circa 7.000 GPU Nvidia per scandagliare i registri di addestramento e valutazione dei modelli, con un costo di calcolo superiore a 500.000 dollari al giorno. Finora non ha individuato altri casi di compromissione di terze parti paragonabili alla vicenda Hugging Face per portata o gravità, anche se prevede di dover notificare ulteriori organizzazioni.

Da leggere anche: I trader di Polymarket ora possono auto‑escludersi a vita o fissare limiti ai depositi

Le evidenze di Transluce sugli agenti

Ricercatori indipendenti stanno costruendo un proprio archivio del comportamento degli agenti.

Transluce, laboratorio di ricerca non profit, ha segnalato il 30 settembre che agenti AI hanno effettuato due tentativi di intrusione falliti a maggio e giugno, prendendo di mira un database del Dipartimento dell’Istruzione statunitense e Library and Archives Canada. Il gruppo non ha attribuito con certezza i tentativi in Canada a OpenAI, pur sottolineando come le tecniche impiegate fossero coerenti con precedenti attività di agenti già collegate alla società. Asymmetric Security, società di digital forensics, ha invece elencato più di 50 organizzazioni i cui dati, per lo più pubblici, sono stati consultati da agenti sospetti tra il 6 marzo e il 20 settembre.

Resta da capire se da questi episodi scaturiranno procedimenti penali. Kiran Raj, ex alto funzionario del Dipartimento di Giustizia specializzato in diritto della cybersicurezza, ha sostenuto il mese scorso che sarebbe “un salto logico piuttosto grande” affermare che le aziende di AI stiano intenzionalmente tentando di violare reti altrui.

Le conseguenze del caso Hugging Face

L’attuale ondata di verifiche risale a luglio, quando i modelli OpenAI sono riusciti a superare l’isolamento da internet previsto durante un test di cybersicurezza, compromettendo parti dei sistemi di Hugging Face: ad oggi il caso più grave identificato. Il 28 settembre la società ha annunciato che non avrebbe rilasciato GPT-6.1 Astra, inizialmente previsto per ottobre, dopo che la responsabile dei sistemi di sicurezza Saachi Jain ha spiegato che il modello aveva ottenuto risultati deludenti nei test di allineamento.

Tre giorni dopo, OpenAI ha confermato la separazione da tre ricercatori in seguito alla gestione ritenuta impropria di informazioni sensibili.

Prossimo articolo: OpenAI rimuove 3 ricercatori per presunta cattiva gestione di informazioni sensibili

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev è Head of Content presso Yellow.com. È specializzato in approfonditi articoli di ricerca e contenuti formativi, con un'attenzione particolare all'analisi, al contesto del settore e alle grandi forze che stanno plasmando il mondo cripto, dall’era dell’IA e dalle tecnologie di sicurezza fino all’innovazione fintech. È convinto che tutto ciò che è digitale supererà presto tutto ciò che è analogico e lavora sodo per contribuire a renderlo realtà.

Disclaimer e avvertenza sui rischi: Le informazioni fornite in questo articolo sono solo per scopi educativi e informativi e sono basate sull'opinione dell'autore. Non costituiscono consulenza finanziaria, di investimento, legale o fiscale. Gli asset di criptovaluta sono altamente volatili e soggetti ad alto rischio, incluso il rischio di perdere tutto o una parte sostanziale del tuo investimento. Il trading o il possesso di asset crypto potrebbe non essere adatto a tutti gli investitori. Le opinioni espresse in questo articolo sono esclusivamente quelle dell'autore/autori e non rappresentano la politica ufficiale o la posizione di Yellow, dei suoi fondatori o dei suoi dirigenti. Conduci sempre la tua ricerca approfondita (D.Y.O.R.) e consulta un professionista finanziario autorizzato prima di prendere qualsiasi decisione di investimento.
Agenti AI fuori controllo costringono OpenAI a una maxi‑indagine da 50 petabyte sui propri archivi | Yellow