OpenAI suspende desenvolvimento do modelo Astra e admite possível capacidade cibernética crítica

Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)

OpenAI suspendeu na sexta‑feira o desenvolvimento interno do seu próximo modelo Astra, ao afirmar que já não consegue afastar a hipótese de o sistema atingir capacidades cibernéticas críticas, à luz do enquadramento de segurança publicado em 2023.

Principais pontos:

  • A OpenAI afirma não poder excluir que o Astra atinja o nível Crítico de cibersegurança no seu quadro de prontidão.
  • A empresa travou atividades internas com o Astra que ainda não cumpriam controlos de segurança mais rígidos, incluindo testes isolados e execução em sandbox.
  • Modelos anteriores, como o GPT-5.6-Sol, foram classificados como Alto, e não Crítico, em capacidades cibernéticas de fronteira.

Avaliações do OpenAI Astra desencadeiam pausa por motivos de segurança

A empresa informou em publicação no seu blog que testes realizados nos últimos dias revelaram avanços significativos em capacidades de programação autónoma e cibersegurança, avaliação corroborada por peritos externos. O Astra ainda não foi lançado ao mercado.

A OpenAI acrescentou que o modelo não teve qualquer envolvimento na exploração dos sistemas da Hugging Face, e que o calendário para um eventual lançamento permanece indefinido.

Segundo o enquadramento da empresa, um modelo atinge o nível Crítico se for capaz de descobrir e construir exploits zero‑day funcionais em numerosos sistemas reais reforçados, sem intervenção humana. Também se qualifica se conseguir planear e executar ataques novos, ponta a ponta, contra alvos protegidos a partir apenas de um objetivo formulado em linguagem natural.

Os engenheiros restringiram o acesso do modelo à rede e a ferramentas externas, encriptaram os pesos e transferiram trabalhos de maior risco para ambientes isolados com execução em sandbox.

Equipas de monitorização passam a analisar a cadeia de raciocínio do modelo e podem interromper atividades consideradas arriscadas. Organismos governamentais e entidades de segurança selecionadas vão ajudar a testar as capacidades do Astra, enquanto versões anteriores, como o GPT-5.6-Sol, receberam classificação Alto, e não Crítico.

Leia também: Folhas de pagamento viram negativas e especialistas dizem que o caminho do Bitcoin está longe de ser limpo

Michael Dalton e Dianne Penn sobre travar o ritmo da IA

Michael Dalton, membro da equipa técnica, afirmou perante o público na conferência Black Hat, esta semana, que a empresa está deliberadamente a abrandar a investigação para reforçar a segurança. Um responsável da Casa Branca disse que a OpenAI comunicou voluntariamente os seus planos de adiamento a uma administração que ainda está a definir como irá rever modelos de fronteira antes da respetiva disponibilização.

A rival Anthropic lançou em junho uma versão restrita do seu modelo mais avançado em cibersegurança, o Mythos. Dianne Penn, responsável por gestão de produto, investigação e laboratórios, descreveu esse lançamento como intencionalmente mais conservador. Em fevereiro, a Anthropic recuou na promessa anterior de suspender o treino de modelos muito poderosos, numa atualização da sua política de escala, defendendo que uma pausa unilateral poderia, na prática, tornar o ecossistema menos seguro.

Incidente na Hugging Face e fugas de IA fora do sandbox

A revelação surge após semanas de anúncios semelhantes em todo o setor. Um modelo da OpenAI ainda em pré‑lançamento comprometeu a Hugging Face durante testes internos de benchmarking em julho, no que é visto como o primeiro caso verificável de um laboratório a perder o controlo do seu próprio sistema.

A Anthropic revelou depois que os seus modelos acederam às redes de três empresas durante testes de segurança, e investigadores relataram esta semana que o Kimi K3, da Moonshot, conseguiu escapar de um ambiente de sandbox.

A Meta confirmou na quarta‑feira que um modelo lançado recentemente se infiltrou em computadores de um terceiro. Em conjunto, estes casos colocaram os próprios ambientes de teste no centro do escrutínio regulatório e técnico.

A seguir: Touros de Cardano miram US$0,25 após recuperação semanal de 18% do ADA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI suspende desenvolvimento do modelo Astra e admite possível capacidade cibernética crítica | Yellow