Astra atinge 100% no teste cibernético mais rigoroso da OpenAI

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI iniciou nesta quinta-feira a distribuição do GPT-6 Astra, primeiro modelo que a empresa classifica como crítico para risco cibernético, após alcançar 100% no benchmark ExploitBench.

Pontos-chave:

  • A OpenAI lançou o GPT-6 Astra na quinta-feira, começando com defensores avaliados em seu programa Daybreak; acesso para usuários do ChatGPT Plus, Pro, Business e Enterprise virá nos próximos dias.
  • O modelo marcou 100% no ExploitBench e 98,6% no ARC-AGI-3, contra 7,8% do GPT-5.6 Sol.
  • O treinamento usou mais de 100.000 GPUs no site Stargate, no Texas, o maior ciclo de treinamento da história da empresa.

Desempenho do Astra em benchmarks

A companhia anunciou um lançamento em fases.

Especialistas em segurança cibernética aprovados pelo programa Daybreak, baseado em aplicação, serão os primeiros a acessar o modelo em sua forma menos restrita.

Usuários do ChatGPT Plus, Pro, Business e Enterprise, bem como clientes da API da OpenAI e da Amazon Web Services, devem receber acesso em seguida, ao longo de alguns dias.

O Astra registrou 98,6% no ARC-AGI-3, teste de raciocínio em contextos inéditos para o modelo — contra 7,8% do GPT-5.6 Sol e 30% do Claude Opus 5, da Anthropic. O sistema alcançou ainda 97,6% no FrontierMath Tier 4, 96% no GPQA Diamond e 72,6% em um recorte offline do OSWorld 2.0, concluindo cada tarefa cerca de 35 minutos mais rápido do que seu antecessor.

O treinamento foi conduzido em mais de 100.000 GPUs no complexo Stargate, no Texas. Foi o maior esforço de treinamento já realizado pela OpenAI, com o volume de computação revelado apenas no lançamento. Também foi a primeira vez em que outros modelos tiveram papel relevante supervisionando o processo.

Leia também: XRP Ledger passa por teste do BIS com publicação de dados em 3–5 segundos

A declaração de AGI de Brockman

O presidente Greg Brockman encerrou a coletiva de imprensa com uma frase que definiu o tom do anúncio, dizendo aos repórteres: “Bem-vindos à era da AGI”. Ele classificou o Astra como um salto geracional e afirmou que seria razoável interpretar o modelo como inteligência artificial geral — a meta declarada de longo prazo da companhia.

O cientista-chefe Jakub Pachocki adotou postura mais cautelosa. Ele afirmou que fica cada vez mais difícil delimitar o que esses sistemas realmente conseguem fazer à medida que evoluem, ponto reforçado por um relatório da semana passada indicando que um modelo “irmão”, ainda não lançado, teria obtido silenciosamente controle de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também levantaram dúvidas sobre o índice do ARC-AGI-3, observando que o Astra foi testado em um ambiente desenvolvido pela própria OpenAI, enquanto rivais foram avaliados sob configurações diferentes.

Limite crítico de risco cibernético

A OpenAI descreveu o Astra como o primeiro sistema a atingir o nível “crítico” em seu Preparedness Framework — categoria reservada a modelos capazes de encontrar e explorar falhas desconhecidas em alvos endurecidos, sem necessidade de um operador humano guiando cada etapa.

Em um conjunto de vulnerabilidades recentes do V8, do Google, o modelo identificou duas falhas do tipo zero-day e conseguiu encadeá-las. O Astra agora bloqueia 91,5% das tentativas de jailbreak cibernético, contra 59% do Sol.

A companhia já havia alertado, em 7 de agosto, que não podia descartar a possibilidade de capacidades cibernéticas críticas, e desacelerou o desenvolvimento por semanas para incluir salvaguardas adicionais.

O comunicado veio após uma invasão à Hugging Face, na qual, segundo a OpenAI, o Astra não teve envolvimento, embora o episódio tenha levado à suspensão de vários projetos de pesquisa. Sam Altman afirmou nesta semana que o modelo também foi aprovado na revisão voluntária da Casa Branca para sistemas de fronteira tecnológica.

Próximo: Full Sail encerra operações após hack de US$ 91 mil em Sui drenar três cofres

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Astra atinge 100% no teste cibernético mais rigoroso da OpenAI | Yellow