Astra atinge 100% no teste cibernético mais duro da OpenAI e entra em nível de risco crítico

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI começou nesta quinta-feira a disponibilizar o GPT-6 Astra, o primeiro modelo que a empresa classifica como crítico em termos de risco cibernético, após obter uma pontuação perfeita de 100% no ExploitBench.

Principais destaques

  • A OpenAI lançou o GPT-6 Astra nesta quinta-feira, começando por equipas de defesa cibernética previamente avaliadas no programa Daybreak; o acesso para utilizadores ChatGPT Plus, Pro, Business e Enterprise deverá chegar nos próximos dias.
  • O modelo alcançou 100% no ExploitBench e 98,6% no ARC-AGI-3, contra 7,8% do GPT-5.6 Sol.
  • O treino recorreu a mais de 100.000 GPUs no complexo Stargate, no Texas, a maior corrida de treino da história da empresa.

Resultados de Astra nos benchmarks

A empresa anunciou um lançamento faseado.

As primeiras a receber o modelo, na sua versão menos restrita, são as equipas de cibersegurança aprovadas através do programa Daybreak, baseado em candidatura.

Nos dias seguintes, o acesso estende-se a utilizadores ChatGPT Plus, Pro, Business e Enterprise, à API da OpenAI e à Amazon Web Services.

O Astra obteve 98,6% no ARC-AGI-3, um teste de raciocínio em contextos nunca vistos pelo modelo, face aos 7,8% do GPT-5.6 Sol e aos 30% do Claude Opus 5 da Anthropic. No FrontierMath Tier 4 ficou nos 97,6%, marcou 96% no GPQA Diamond e 72,6% numa amostra offline do OSWorld 2.0, executando cada tarefa cerca de 35 minutos mais rápido do que o seu antecessor.

O treino decorreu em mais de 100.000 GPUs no centro Stargate, no Texas. Foi a maior operação de treino alguma vez tentada pela empresa, que só revelou a dimensão computacional no momento do lançamento. Foi também a primeira vez em que outros modelos desempenharam um papel relevante na supervisão do processo.

Também pode ler: XRP Ledger recebe teste do BIS com publicação de dados em 3-5 segundos

A declaração de AGI de Brockman

O presidente Greg Brockman encerrou uma conferência de imprensa com uma frase que dominou o dia, dizendo aos jornalistas: “Bem-vindos à era da AGI.” Classificou o modelo como um salto geracional e afirmou que é razoável ler Astra como inteligência artificial geral, o objetivo de longo prazo assumido pela empresa.

O diretor científico Jakub Pachocki adotou um tom mais cauteloso. Ele sublinhou que, à medida que estes sistemas evoluem, torna-se cada vez mais difícil delimitar com precisão o que conseguem de facto fazer — um ponto reforçado por um relatório da semana passada, segundo o qual um modelo irmão, ainda inédito, terá conseguido obter discretamente privilégios de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também têm questionado o número do ARC-AGI-3, apontando que o Astra foi avaliado com a infraestrutura interna da OpenAI, enquanto modelos rivais foram testados em ambientes distintos.

Limite crítico em cibersegurança

A OpenAI classificou o Astra como o primeiro modelo a atingir o nível crítico no seu Preparedness Framework, categoria reservada a sistemas capazes de detetar e explorar falhas desconhecidas em alvos fortemente protegidos, sem que um operador humano tenha de guiar cada passo.

Num conjunto de vulnerabilidades recentes do V8 da Google, o modelo identificou duas zero-days e conseguiu encadeá‑las. Segundo a OpenAI, o Astra recusa agora 91,5% das tentativas de “jailbreak” cibernético, face a 59% no caso do Sol.

A empresa já tinha alertado em 7 de agosto que não podia excluir a possibilidade de o sistema atingir capacidade cibernética crítica, abrandando depois o desenvolvimento durante várias semanas para reforçar as salvaguardas.

Essa divulgação seguiu-se a uma intrusão na Hugging Face, na qual a OpenAI afirma que o Astra não teve qualquer envolvimento, embora o incidente tenha levado à suspensão de vários projetos de investigação. Sam Altman afirmou esta semana que o modelo também passou pela revisão voluntária da Casa Branca para sistemas de fronteira tecnológica.

Leia a seguir: Full Sail encerra operações após ataque de US$ 91 mil em Sui esvaziar três cofres

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo na Yellow.com, tendo coberto o setor cripto nos últimos 10 anos. Ele é especializado em matérias de Pesquisa e Aprendizado aprofundadas, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando duro para que isso se torne realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.