Três pesquisadores demitidos pela OpenAI pediram ao conselho da empresa, em uma carta de 7 de outubro, que interrompesse trabalhos que tornam a IA mais difícil de monitorar. Um memorando interno da companhia endossou as recomendações do grupo.
Pontos-chave:
- Três pesquisadores demitidos pela OpenAI enviaram ao conselho, em 7 de outubro, uma carta pedindo a suspensão de trabalhos que enfraqueçam o monitoramento de IA.
- A OpenAI afirma que as demissões não têm relação com questões de segurança, e um memorando interno concorda fortemente com as recomendações da carta.
- O “system card” do GPT-6 Astra indica que o modelo da OpenAI é mais difícil de monitorar que o GPT-5.6 Sol.
Detalhes da carta ao conselho da OpenAI
Tomek Korbak, Mikita Balesni e Jasmine Wang, que atuavam em segurança e alinhamento de modelos na empresa, endereçaram a carta ao conselho da OpenAI e a seus comitês de segurança, de acordo com trechos publicados na quarta-feira.
O texto completo ainda não foi divulgado. Nos trechos revelados, os pesquisadores afirmam que “como setor, ainda não sabemos como desenvolver e implantar com segurança modelos que não conseguimos monitorar”.
Segundo eles, nem a OpenAI nem seus concorrentes deveriam avançar em linhas de pesquisa que reduzam ainda mais essa capacidade. A carta também teria pedido que a OpenAI trabalhe com auditores independentes e apoie um ecossistema de segurança aberto e transparente, além de afirmar que as demissões estão “intimidando quem permanece na OpenAI”.
Leia também: CrowdStrike suspeita que hacker de 26 anos na China atacou bancos coreanos com Claude Code
Memorando da OpenAI e demissões
Um porta-voz da OpenAI declarou que as demissões “não tiveram relação com levantar preocupações de segurança ou se manifestar publicamente”. O representante compartilhou parte de um memorando interno, enviado na quarta-feira por um líder de pesquisa, que “concorda fortemente” com as recomendações da carta. Em 1.º de outubro, a OpenAI afirmou que uma investigação interna concluiu que três funcionários trataram de forma inadequada informações sensíveis e violaram políticas da empresa, em um caso envolvendo um grupo externo que avalia modelos de IA.
A OpenAI não divulgou publicamente o nome dos pesquisadores nem o da organização envolvida.
Preocupações com o monitoramento do GPT-6 Astra
O “chain of thought” (cadeia de raciocínio) é o passo a passo que o modelo escreve antes de responder, e que as equipes de segurança analisam em busca de sinais de comportamento indevido.
O system card do GPT-6 Astra, publicado em 3 de setembro, afirma que o modelo é mais difícil de monitorar dessa forma do que o GPT-5.6 Sol, e que tem maior capacidade de controlar a própria cadeia de raciocínio. Segundo o documento, modelos da família Astra “podem driblar nossos monitores de CoT em condições adversariais”.
As conclusões vêm principalmente de testes em que o modelo é instruído a evitar o monitoramento, e a OpenAI relata não ter encontrado evidências de que o Astra esconda seu raciocínio em textos aparentemente não relacionados.
A companhia afirma considerar a preservação desse tipo de monitoramento um objetivo central de pesquisa e diz que não aceitará novas perdas além de um certo limite sem antes dispor de métodos alternativos para demonstrar que seus modelos estão alinhados.
Os três pesquisadores têm histórico no tema. Korbak e Balesni lideraram um artigo de julho de 2025, coassinado por Wang e por pesquisadores da OpenAI, Google DeepMind e Anthropic, que descreve o monitoramento por cadeia de raciocínio como uma oportunidade nova e frágil para a segurança em IA. O system card do Astra cita esse estudo, que recomenda aos desenvolvedores avaliar como suas decisões de design afetam a capacidade de monitorar o raciocínio interno de um modelo.
Veja a seguir: Agentes de IA sem nuvem: Microsoft e Nvidia preparam Surface Laptop com 128 GB

