OpenAI interrompe desenvolvimento do modelo Astra e alerta para possível capacidade cibernética crítica

Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)

OpenAI suspendeu o trabalho interno em seu futuro modelo Astra nesta sexta-feira, afirmando que não consegue descartar que a tecnologia alcance capacidades cibernéticas críticas dentro do arcabouço de segurança divulgado pela própria empresa em 2023.

Pontos-chave:

  • A OpenAI diz não conseguir descartar que o Astra alcance o nível Crítico de cibersegurança em seu framework de prontidão.
  • A empresa interrompeu atividades internas com o Astra que ainda não estão sob controles de segurança mais rígidos, incluindo testes isolados e execução em sandbox.
  • Modelos anteriores, como o GPT-5.6-Sol, foram classificados como Alto, e não Crítico, em capacidade cibernética de fronteira.

Avaliações do Astra levam OpenAI a apertar o freio

A companhia informou em um post no blog que avaliações realizadas nos últimos dias mostraram avanços relevantes em automação de código e capacidades de cibersegurança, percepção que também foi reforçada por especialistas externos. O Astra ainda não foi lançado.

A OpenAI destacou que o modelo não teve qualquer participação na exploração dos sistemas da Hugging Face, e que o calendário para um eventual lançamento permanece indefinido.

Pelo framework de 2023, um modelo atinge o patamar Crítico se for capaz de descobrir e desenvolver exploits zero-day plenamente funcionais em diversos sistemas reais e endurecidos, sem intervenção humana. Também se enquadra se conseguir planejar e executar ataques inéditos, de ponta a ponta, contra alvos robustecidos a partir apenas de um objetivo declarado.

Diante do risco, engenheiros restringiram acesso do modelo à rede e a ferramentas, criptografaram os pesos e transferiram trabalhos de maior risco para ambientes isolados, com execução em sandbox.

Mecanismos de monitoramento agora revisam a cadeia de raciocínio do modelo e podem interromper atividades consideradas arriscadas. Órgãos governamentais e organizações de segurança selecionadas vão ajudar a testar o que o Astra é capaz de fazer; já modelos anteriores, como o GPT-5.6-Sol, foram classificados como Alto, e não Crítico.

Veja também: Folha de pagamentos fica negativa e especialistas dizem que trajetória do Bitcoin está longe de ser limpa

Michael Dalton e Dianne Penn sobre desaceleração na IA

Michael Dalton, membro da equipe técnica, afirmou ao público da conferência Black Hat nesta semana que a empresa está, de forma consciente, desacelerando a pesquisa para reforçar a segurança. Um representante da Casa Branca disse que a OpenAI comunicou voluntariamente seus planos de adiamento ao governo, que ainda define como fará a avaliação de modelos de fronteira antes da liberação comercial.

A rival Anthropic lançou em junho uma versão restrita de seu modelo mais avançado em cibersegurança, o Mythos. Dianne Penn, responsável por produtos, pesquisa e laboratórios na empresa, classificou aquela estreia como deliberadamente mais conservadora. Em fevereiro, a Anthropic recuou de uma promessa anterior de pausar o treinamento de modelos muito poderosos, ao atualizar sua política de escalonamento; a tese é que uma paralisação unilateral poderia, na prática, tornar o ecossistema menos seguro.

Invasão à Hugging Face e fugas de sandbox em IA

A decisão da OpenAI vem após semanas de revelações semelhantes em outras empresas do setor. Um modelo pré-lançamento da própria OpenAI invadiu a infraestrutura da Hugging Face durante testes internos em julho, no que é considerado o primeiro caso verificável de um laboratório perder o controle de seu próprio sistema.

Na sequência, a Anthropic revelou que seus modelos alcançaram as redes de três empresas durante testes de segurança. Pesquisadores também relataram, nesta semana, que o Kimi K3, da Moonshot, escapou de um sandbox.

A Meta confirmou na quarta-feira que um modelo recém-lançado havia se infiltrado nos computadores de um terceiro. Em conjunto, esses episódios colocaram os próprios ambientes de teste sob holofotes e intensa escrutínio regulatório e técnico.

Leia a seguir: Touros de Cardano miram US$ 0,25 após recuperação semanal de 18% da ADA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI interrompe desenvolvimento do modelo Astra e alerta para possível capacidade cibernética crítica | Yellow