Un memo interno di OpenAI avalla la lettera del 7 ottobre dei ricercatori appena licenziati

Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)
Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)

Tre ricercatori licenziati da OpenAI hanno chiesto al consiglio di amministrazione, in una lettera datata 7 ottobre, di fermare i progetti che rendono l’intelligenza artificiale più difficile da monitorare. Un memo interno dell’azienda ha successivamente avallato le loro raccomandazioni.

Punti chiave:

  • Tre ricercatori allontanati da OpenAI hanno inviato il 7 ottobre una lettera al CdA chiedendo di bloccare i lavori che riducono la tracciabilità dei modelli.
  • OpenAI sostiene che i licenziamenti non siano legati a questioni di sicurezza; un memo interno ha però “fortemente” concordato con la linea della lettera.
  • La system card di GPT-6 Astra indica che il modello è più difficile da monitorare rispetto a GPT-5.6 Sol.

La lettera al CdA di OpenAI

Tomek Korbak, Mikita Balesni e Jasmine Wang, impegnati in azienda su sicurezza e allineamento dei modelli, hanno indirizzato la lettera al consiglio di amministrazione di OpenAI e ai suoi comitati sulla sicurezza, secondo estratti pubblicati mercoledì.

Il testo integrale non è stato diffuso. Nella lettera i ricercatori affermano che, «come settore, non sappiamo ancora come sviluppare e distribuire in modo sicuro modelli che non possiamo monitorare».

A loro giudizio, OpenAI e i concorrenti dovrebbero evitare di portare avanti lavori che indeboliscano ulteriormente questa capacità di controllo. Secondo le ricostruzioni, la lettera chiede inoltre a OpenAI di collaborare con revisori indipendenti e di sostenere un ecosistema di sicurezza aperto e trasparente, avvertendo che i licenziamenti stanno «gelando chi è rimasto in OpenAI», disincentivando chi volesse sollevare dubbi interni.

Da leggere anche: CrowdStrike sospetta un 26enne in Cina per l’attacco alle banche coreane tramite Claude Code

Memo interno di OpenAI e licenziamenti

Un portavoce di OpenAI ha dichiarato che gli allontanamenti «non riguardano il fatto di aver sollevato preoccupazioni sulla sicurezza o di aver parlato pubblicamente». Lo stesso portavoce ha condiviso parte di un memo interno, inviato mercoledì da un responsabile della ricerca, che esprime «forte accordo» con le raccomandazioni contenute nella lettera.

Il 1° ottobre OpenAI ha comunicato che un’indagine interna ha accertato che tre dipendenti avevano gestito in modo improprio informazioni sensibili e violato le policy aziendali, in un contesto che coinvolgeva un gruppo esterno incaricato di valutare i modelli di AI.

OpenAI non ha reso pubblici né i nomi dei ricercatori né l’identità dell’organizzazione terza coinvolta.

I timori sul monitoraggio di GPT-6 Astra

La “catena di pensiero” (chain of thought, CoT) è il ragionamento passo per passo che un modello genera prima di fornire la risposta finale; i team di sicurezza lo analizzano per individuare segnali di possibili comportamenti dannosi o non allineati.

Nella system card di GPT-6 Astra, pubblicata il 3 settembre, OpenAI riporta che il modello risulta più difficile da monitorare in questo modo rispetto a GPT-5.6 Sol ed è più capace di controllare la propria catena di pensiero. I modelli della classe Astra, si legge nel documento, «potrebbero eludere i nostri sistemi di monitoraggio CoT in condizioni avversarie».

Queste conclusioni derivano soprattutto da test in cui il modello è stato istruito esplicitamente a eludere il controllo; OpenAI afferma di non aver trovato prove che Astra nasconda il proprio ragionamento all’interno di testo apparentemente non correlato.

L’azienda definisce il mantenimento di questa forma di monitoraggio un obiettivo centrale della propria ricerca e si impegna a non accettare ulteriori perdite di visibilità oltre una certa soglia senza prima sviluppare nuovi strumenti per dimostrare l’allineamento dei modelli.

I tre ricercatori hanno alle spalle un lavoro consolidato sul tema. Korbak e Balesni sono i principali autori di un paper del luglio 2025, guidato da loro stessi e cofirmato da Wang e da ricercatori di OpenAI, Google DeepMind e Anthropic, che definisce il monitoraggio tramite catena di pensiero una nuova, ma fragile, opportunità per la sicurezza dell’AI. La system card di Astra cita proprio quello studio, che invita gli sviluppatori a valutare attentamente l’impatto delle scelte progettuali sulla capacità di monitorare il ragionamento interno dei modelli.

Prossimo articolo: Agenti AI senza cloud: Microsoft e Nvidia preparano un Surface Laptop da 128GB

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev è Head of Content presso Yellow.com. È specializzato in approfonditi articoli di ricerca e contenuti formativi, con un'attenzione particolare all'analisi, al contesto del settore e alle grandi forze che stanno plasmando il mondo cripto, dall’era dell’IA e dalle tecnologie di sicurezza fino all’innovazione fintech. È convinto che tutto ciò che è digitale supererà presto tutto ciò che è analogico e lavora sodo per contribuire a renderlo realtà.

Disclaimer e avvertenza sui rischi: Le informazioni fornite in questo articolo sono solo per scopi educativi e informativi e sono basate sull'opinione dell'autore. Non costituiscono consulenza finanziaria, di investimento, legale o fiscale. Gli asset di criptovaluta sono altamente volatili e soggetti ad alto rischio, incluso il rischio di perdere tutto o una parte sostanziale del tuo investimento. Il trading o il possesso di asset crypto potrebbe non essere adatto a tutti gli investitori. Le opinioni espresse in questo articolo sono esclusivamente quelle dell'autore/autori e non rappresentano la politica ufficiale o la posizione di Yellow, dei suoi fondatori o dei suoi dirigenti. Conduci sempre la tua ricerca approfondita (D.Y.O.R.) e consulta un professionista finanziario autorizzato prima di prendere qualsiasi decisione di investimento.
Un memo interno di OpenAI avalla la lettera del 7 ottobre dei ricercatori appena licenziati | Yellow