Astra atinge 100% no teste cibernético mais rigoroso da OpenAI

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI começou nesta quinta-feira a disponibilizar o GPT-6 Astra, o primeiro modelo que a empresa classifica formalmente como crítico em termos de risco cibernético, depois de obter 100% de acerto no benchmark ExploitBench.

Principais pontos:

  • A OpenAI lançou o GPT-6 Astra nesta quinta-feira, começando por equipas de defesa cibernética avaliadas no programa Daybreak; o acesso via ChatGPT Plus, Pro, Business e Enterprise será aberto nos próximos dias.
  • O modelo obteve 100% no ExploitBench e 98,6% no ARC-AGI-3, face a 7,8% do GPT-5.6 Sol.
  • O treino utilizou mais de 100.000 GPUs no centro Stargate, no Texas, a maior execução computacional da história da empresa.

Desempenho do Astra nos benchmarks

A empresa anunciou um lançamento faseado.

Defensores de cibersegurança aprovados através do programa Daybreak, baseado em candidatura, são os primeiros a aceder ao modelo na sua forma menos restrita.

Usuários de ChatGPT Plus, Pro, Business e Enterprise, clientes da API da OpenAI e da Amazon Web Services deverão receber acesso nos dias seguintes.

O Astra registou 98,6% no ARC-AGI-3, um teste de raciocínio em cenários nunca vistos pelo modelo, contra 7,8% do GPT-5.6 Sol e 30% do Claude Opus 5, da Anthropic. Alcançou ainda 97,6% no FrontierMath Tier 4, 96% no GPQA Diamond e 72,6% numa amostra offline do OSWorld 2.0, executando cada tarefa cerca de 35 minutos mais rápido do que o seu antecessor.

O treino decorreu com mais de 100.000 GPUs no site Stargate, no Texas. Foi a maior corrida de treino já realizada pela OpenAI, e o número total de computação só foi revelado no lançamento. Pela primeira vez, outros modelos desempenharam um papel relevante na supervisão do processo.

Também leia: XRP Ledger recebe teste do BIS com publicação de dados em 3–5 segundos

A declaração de AGI de Brockman

O presidente Greg Brockman encerrou uma conferência de imprensa com uma frase que definiu o tom do dia, afirmando aos jornalistas: “Bem-vindos à era da AGI.” Ele classificou o modelo como um salto geracional e disse ser razoável interpretar o Astra como inteligência artificial geral, o objetivo de longa data da empresa.

O cientista-chefe Jakub Pachocki foi mais cauteloso. Ele observou que definir claramente o que estes sistemas conseguem efetivamente fazer se torna mais difícil à medida que melhoram — ponto reforçado por um relatório, na semana anterior, de que um modelo-irmão ainda inédito conseguiu, silenciosamente, obter privilégios de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também questionaram o valor do ARC-AGI-3, sublinhando que o Astra foi testado no próprio ambiente da OpenAI, enquanto modelos rivais foram avaliados com configurações diferentes.

Limite crítico de risco cibernético

A OpenAI descreveu o Astra como o primeiro modelo a atingir o nível crítico do seu Preparedness Framework, categoria reservada a sistemas capazes de identificar e explorar falhas desconhecidas em alvos endurecidos, sem necessidade de um operador humano guiando cada passo.

Num conjunto de vulnerabilidades recentes do Google V8, o modelo descobriu duas falhas de dia zero e conseguiu encadeá‑las em cadeia de exploração. O Astra agora recusa 91,5% das tentativas de “jailbreak” cibernético, contra 59% do Sol.

A empresa já tinha alertado, em 7 de agosto, que não conseguia excluir a possibilidade de capacidades cibernéticas críticas, e abrandou o desenvolvimento durante semanas para incorporar salvaguardas adicionais.

Essa comunicação seguiu‑se a uma intrusão na Hugging Face, na qual a OpenAI afirma que o Astra não teve qualquer participação, embora o episódio tenha levado à suspensão de vários projetos de pesquisa. Sam Altman afirmou esta semana que o modelo também passou pela revisão voluntária da Casa Branca para sistemas de fronteira tecnológica.

Leia a seguir: Full Sail encerra operações após ataque a Sui de US$ 91 mil esvaziar três cofres

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Astra atinge 100% no teste cibernético mais rigoroso da OpenAI | Yellow