Astra atinge 100% no benchmark cibernético mais rigoroso da OpenAI

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

A OpenAI começou nesta quinta-feira a liberar o GPT-6 Astra, primeiro modelo da casa oficialmente classificado como crítico em risco cibernético, após cravar 100% no ExploitBench.

Principais pontos:

  • OpenAI lançou o GPT-6 Astra nesta quinta, começando por defensores testados em seu programa Daybreak; assinantes do ChatGPT Plus, Pro, Business e Enterprise devem receber acesso nos próximos dias.
  • O modelo marcou 100% no ExploitBench e 98,6% no ARC-AGI-3, contra 7,8% do GPT-5.6 Sol.
  • O treinamento usou mais de 100 mil GPUs no site Stargate, no Texas, no maior experimento de treinamento da empresa até agora.

Desempenho do Astra em benchmarks

A companhia anunciou uma liberação em fases.

Profissionais de segurança cibernética aprovados via o programa Daybreak, baseado em aplicação, são os primeiros a acessar o modelo em sua forma menos restrita.

Usuários do ChatGPT Plus, Pro, Business e Enterprise, clientes da API da OpenAI e da Amazon Web Services devem ser contemplados em seguida, ao longo de poucos dias.

O Astra registrou 98,6% no ARC-AGI-3, teste de raciocínio em cenários inéditos para o modelo, frente a 7,8% do GPT-5.6 Sol e 30% do Claude Opus 5, da Anthropic. No FrontierMath Tier 4 fez 97,6%, alcançou 96% no GPQA Diamond e 72,6% em um recorte offline do OSWorld 2.0, completando cada tarefa cerca de 35 minutos mais rápido que seu antecessor.

O treinamento rodou em mais de 100 mil GPUs no complexo Stargate, no Texas. Foi a maior rodada de treinamento já tentada pela empresa, que só revelou o volume de computação no lançamento. Foi também a primeira em que outros modelos tiveram papel relevante supervisionando o processo.

Veja também: XRP Ledger recebe teste do BIS com publicação de dados em 3 a 5 segundos

A declaração de AGI de Brockman

O presidente Greg Brockman encerrou uma coletiva de imprensa com a frase que pautou o dia, dizendo a repórteres: “Bem-vindos à era da AGI”. Ele classificou o modelo como um salto geracional e afirmou que seria razoável enxergar o Astra como inteligência artificial geral, o objetivo de longo prazo declarado pela empresa.

O cientista-chefe Jakub Pachocki foi mais cauteloso. Ele afirmou que fica cada vez mais difícil delimitar o que esses sistemas realmente conseguem fazer à medida que evoluem – ponto reforçado por um relatório, na semana passada, de que um modelo-irmão ainda não lançado teria obtido discretamente controle de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também contestaram o número do ARC-AGI-3, observando que o Astra foi testado no ambiente interno da OpenAI, enquanto rivais rodaram em configurações distintas.

Limiar crítico em cibersegurança

A OpenAI descreveu o Astra como o primeiro modelo a atingir o nível crítico em seu Preparedness Framework, categoria reservada a sistemas capazes de encontrar e explorar falhas desconhecidas em alvos reforçados, sem depender de orientação humana passo a passo.

Em um conjunto de vulnerabilidades recentes no V8, do Google, o modelo identificou duas falhas do tipo zero-day e conseguiu encadeá-las. Segundo a empresa, o Astra hoje bloqueia 91,5% das tentativas de “jailbreak” cibernético, frente a 59% do Sol.

A companhia havia alertado, em 7 de agosto, que não podia descartar capacidades cibernéticas críticas no modelo, e então desacelerou o desenvolvimento por algumas semanas para incluir novas salvaguardas.

A revelação veio na esteira de uma invasão à Hugging Face, da qual a OpenAI afirma que o Astra não participou, embora o episódio tenha levado à suspensão de diversos projetos de pesquisa. Sam Altman disse nesta semana que o modelo também foi aprovado na avaliação voluntária da Casa Branca para sistemas de fronteira tecnológica.

Leia a seguir: Full Sail encerra operações após ataque de US$ 91 mil em Sui drenar três cofres

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com e cobre o setor de criptomoedas há 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto de indústria e nas grandes forças que moldam o mercado cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo que é digital em breve superará tudo que é analógico e trabalha intensamente para ajudar a tornar isso realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Astra atinge 100% no benchmark cibernético mais rigoroso da OpenAI | Yellow