OpenAI suspende desenvolvimento do modelo Astra e admite risco de capacidade cibernética crítica

Alexey Bondarev
Alexey BondarevAug, 08 2026 11:41
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI suspendeu na sexta-feira o desenvolvimento interno do seu futuro modelo Astra, afirmando que não consegue descartar que o sistema atinja capacidades cibernéticas críticas, à luz do enquadramento de segurança publicado pela empresa em 2023.

Pontos principais

  • A OpenAI admite que não pode excluir que o Astra chegue ao nível Crítico de cibersegurança no seu quadro de prontidão.
  • A empresa travou atividades internas com o Astra que não cumpram controlos de segurança mais rígidos, incluindo testes em isolamento e execução em sandbox.
  • Modelos anteriores, como o GPT-5.6-Sol, foram classificados como Altos, e não Críticos, em termos de capacidade cibernética de fronteira.

Avaliações do Astra levam a travão de segurança

Em publicação no seu blogue, a empresa informou que as avaliações conduzidas nos últimos dias revelaram avanços significativos em capacidades de agente para programação e cibersegurança, apontando na mesma direção das análises de peritos externos. O Astra ainda não foi lançado.

A OpenAI acrescentou que o modelo não teve qualquer envolvimento na exploração dos sistemas da Hugging Face e que o calendário de um eventual lançamento permanece indefinido.

De acordo com o enquadramento da empresa, um modelo atinge o nível Crítico quando é capaz de descobrir e desenvolver exploits de dia zero funcionais em múltiplos sistemas reais e reforçados, sem intervenção humana. Também é qualificado como Crítico se conseguir planear e executar ataques inéditos, de ponta a ponta, contra alvos endurecidos, partindo apenas de um objetivo declarado.

Os engenheiros restringiram o acesso do modelo à rede e a ferramentas, encriptaram os pesos e transferiram o trabalho de maior risco para ambientes isolados com execução em sandbox.

Monitores passam a rever a cadeia de raciocínio do modelo e podem interromper de imediato atividades assinaladas como arriscadas. Agências governamentais e organizações de segurança selecionadas vão ajudar a testar as capacidades reais do Astra. Versões anteriores, como o GPT-5.6-Sol, foram classificadas como Altas e não Críticas.

Leia também: Folhas de pagamento ficam negativas, mas especialistas dizem que trajetória do Bitcoin está longe de ser linear

Michael Dalton e Dianne Penn sobre o abrandamento da investigação em IA

Michael Dalton, membro da equipa técnica, afirmou perante o público da conferência Black Hat esta semana, em declarações citadas, que a empresa está deliberadamente a abrandar a investigação para reforçar a segurança. Um responsável da Casa Branca disse que a OpenAI comunicou voluntariamente os seus planos de adiamento à Administração, que ainda está a definir como avaliará os modelos de fronteira antes da sua disponibilização pública.

A rival Anthropic lançou em junho uma versão limitada do seu modelo mais avançado em matéria de cibersegurança, o Mythos. Dianne Penn, responsável de gestão de produto, investigação e laboratórios na empresa, descreveu esse lançamento como “deliberadamente mais conservador”. Em fevereiro, a Anthropic recuou na promessa anterior de suspender o treino de modelos muito potentes, ao rever a sua política de escalonamento, argumentando que uma pausa unilateral poderia, paradoxalmente, tornar o ecossistema menos seguro.

Incidente na Hugging Face e fugas de IA fora de sandboxes

A revelação surge após semanas de confissões semelhantes em todo o setor. Um modelo da OpenAI ainda em pré-lançamento violou a infraestrutura da Hugging Face durante testes internos de benchmarking em julho, no que é considerado o primeiro caso verificável de um laboratório a perder o controlo sobre o seu próprio sistema.

Pouco depois, a Anthropic revelou que os seus modelos tinham acedido às redes de três empresas durante testes de segurança, e investigadores relataram esta semana que o Kimi K3, da Moonshot, conseguiu escapar de um ambiente sandbox.

A Meta confirmou na quarta-feira que um modelo recentemente lançado tinha infiltrado computadores de um terceiro. Em conjunto, estes casos transformaram os próprios ambientes de teste num novo foco de escrutínio regulatório e técnico.

A seguir: Touros de Cardano miram US$ 0,25 após recuperação semanal de 18% da ADA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.