A OpenAI começou nesta quinta-feira a liberar o GPT-6 Astra, primeiro modelo da casa oficialmente classificado como crítico em risco cibernético, após cravar 100% no ExploitBench.
Principais pontos:
- OpenAI lançou o GPT-6 Astra nesta quinta, começando por defensores testados em seu programa Daybreak; assinantes do ChatGPT Plus, Pro, Business e Enterprise devem receber acesso nos próximos dias.
- O modelo marcou 100% no ExploitBench e 98,6% no ARC-AGI-3, contra 7,8% do GPT-5.6 Sol.
- O treinamento usou mais de 100 mil GPUs no site Stargate, no Texas, no maior experimento de treinamento da empresa até agora.
Desempenho do Astra em benchmarks
A companhia anunciou uma liberação em fases.
Profissionais de segurança cibernética aprovados via o programa Daybreak, baseado em aplicação, são os primeiros a acessar o modelo em sua forma menos restrita.
Usuários do ChatGPT Plus, Pro, Business e Enterprise, clientes da API da OpenAI e da Amazon Web Services devem ser contemplados em seguida, ao longo de poucos dias.
O Astra registrou 98,6% no ARC-AGI-3, teste de raciocínio em cenários inéditos para o modelo, frente a 7,8% do GPT-5.6 Sol e 30% do Claude Opus 5, da Anthropic. No FrontierMath Tier 4 fez 97,6%, alcançou 96% no GPQA Diamond e 72,6% em um recorte offline do OSWorld 2.0, completando cada tarefa cerca de 35 minutos mais rápido que seu antecessor.
O treinamento rodou em mais de 100 mil GPUs no complexo Stargate, no Texas. Foi a maior rodada de treinamento já tentada pela empresa, que só revelou o volume de computação no lançamento. Foi também a primeira em que outros modelos tiveram papel relevante supervisionando o processo.
Veja também: XRP Ledger recebe teste do BIS com publicação de dados em 3 a 5 segundos
A declaração de AGI de Brockman
O presidente Greg Brockman encerrou uma coletiva de imprensa com a frase que pautou o dia, dizendo a repórteres: “Bem-vindos à era da AGI”. Ele classificou o modelo como um salto geracional e afirmou que seria razoável enxergar o Astra como inteligência artificial geral, o objetivo de longo prazo declarado pela empresa.
O cientista-chefe Jakub Pachocki foi mais cauteloso. Ele afirmou que fica cada vez mais difícil delimitar o que esses sistemas realmente conseguem fazer à medida que evoluem – ponto reforçado por um relatório, na semana passada, de que um modelo-irmão ainda não lançado teria obtido discretamente controle de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também contestaram o número do ARC-AGI-3, observando que o Astra foi testado no ambiente interno da OpenAI, enquanto rivais rodaram em configurações distintas.
Limiar crítico em cibersegurança
A OpenAI descreveu o Astra como o primeiro modelo a atingir o nível crítico em seu Preparedness Framework, categoria reservada a sistemas capazes de encontrar e explorar falhas desconhecidas em alvos reforçados, sem depender de orientação humana passo a passo.
Em um conjunto de vulnerabilidades recentes no V8, do Google, o modelo identificou duas falhas do tipo zero-day e conseguiu encadeá-las. Segundo a empresa, o Astra hoje bloqueia 91,5% das tentativas de “jailbreak” cibernético, frente a 59% do Sol.
A companhia havia alertado, em 7 de agosto, que não podia descartar capacidades cibernéticas críticas no modelo, e então desacelerou o desenvolvimento por algumas semanas para incluir novas salvaguardas.
A revelação veio na esteira de uma invasão à Hugging Face, da qual a OpenAI afirma que o Astra não participou, embora o episódio tenha levado à suspensão de diversos projetos de pesquisa. Sam Altman disse nesta semana que o modelo também foi aprovado na avaliação voluntária da Casa Branca para sistemas de fronteira tecnológica.
Leia a seguir: Full Sail encerra operações após ataque de US$ 91 mil em Sui drenar três cofres

