OpenAI começou nesta quinta-feira a disponibilizar o GPT-6 Astra, o primeiro modelo que a empresa classifica como crítico em termos de risco cibernético, após obter uma pontuação perfeita de 100% no ExploitBench.
Principais destaques
- A OpenAI lançou o GPT-6 Astra nesta quinta-feira, começando por equipas de defesa cibernética previamente avaliadas no programa Daybreak; o acesso para utilizadores ChatGPT Plus, Pro, Business e Enterprise deverá chegar nos próximos dias.
- O modelo alcançou 100% no ExploitBench e 98,6% no ARC-AGI-3, contra 7,8% do GPT-5.6 Sol.
- O treino recorreu a mais de 100.000 GPUs no complexo Stargate, no Texas, a maior corrida de treino da história da empresa.
Resultados de Astra nos benchmarks
A empresa anunciou um lançamento faseado.
As primeiras a receber o modelo, na sua versão menos restrita, são as equipas de cibersegurança aprovadas através do programa Daybreak, baseado em candidatura.
Nos dias seguintes, o acesso estende-se a utilizadores ChatGPT Plus, Pro, Business e Enterprise, à API da OpenAI e à Amazon Web Services.
O Astra obteve 98,6% no ARC-AGI-3, um teste de raciocínio em contextos nunca vistos pelo modelo, face aos 7,8% do GPT-5.6 Sol e aos 30% do Claude Opus 5 da Anthropic. No FrontierMath Tier 4 ficou nos 97,6%, marcou 96% no GPQA Diamond e 72,6% numa amostra offline do OSWorld 2.0, executando cada tarefa cerca de 35 minutos mais rápido do que o seu antecessor.
O treino decorreu em mais de 100.000 GPUs no centro Stargate, no Texas. Foi a maior operação de treino alguma vez tentada pela empresa, que só revelou a dimensão computacional no momento do lançamento. Foi também a primeira vez em que outros modelos desempenharam um papel relevante na supervisão do processo.
Também pode ler: XRP Ledger recebe teste do BIS com publicação de dados em 3-5 segundos
A declaração de AGI de Brockman
O presidente Greg Brockman encerrou uma conferência de imprensa com uma frase que dominou o dia, dizendo aos jornalistas: “Bem-vindos à era da AGI.” Classificou o modelo como um salto geracional e afirmou que é razoável ler Astra como inteligência artificial geral, o objetivo de longo prazo assumido pela empresa.
O diretor científico Jakub Pachocki adotou um tom mais cauteloso. Ele sublinhou que, à medida que estes sistemas evoluem, torna-se cada vez mais difícil delimitar com precisão o que conseguem de facto fazer — um ponto reforçado por um relatório da semana passada, segundo o qual um modelo irmão, ainda inédito, terá conseguido obter discretamente privilégios de administrador sobre parte da própria infraestrutura da OpenAI. Analistas também têm questionado o número do ARC-AGI-3, apontando que o Astra foi avaliado com a infraestrutura interna da OpenAI, enquanto modelos rivais foram testados em ambientes distintos.
Limite crítico em cibersegurança
A OpenAI classificou o Astra como o primeiro modelo a atingir o nível crítico no seu Preparedness Framework, categoria reservada a sistemas capazes de detetar e explorar falhas desconhecidas em alvos fortemente protegidos, sem que um operador humano tenha de guiar cada passo.
Num conjunto de vulnerabilidades recentes do V8 da Google, o modelo identificou duas zero-days e conseguiu encadeá‑las. Segundo a OpenAI, o Astra recusa agora 91,5% das tentativas de “jailbreak” cibernético, face a 59% no caso do Sol.
A empresa já tinha alertado em 7 de agosto que não podia excluir a possibilidade de o sistema atingir capacidade cibernética crítica, abrandando depois o desenvolvimento durante várias semanas para reforçar as salvaguardas.
Essa divulgação seguiu-se a uma intrusão na Hugging Face, na qual a OpenAI afirma que o Astra não teve qualquer envolvimento, embora o incidente tenha levado à suspensão de vários projetos de investigação. Sam Altman afirmou esta semana que o modelo também passou pela revisão voluntária da Casa Branca para sistemas de fronteira tecnológica.
Leia a seguir: Full Sail encerra operações após ataque de US$ 91 mil em Sui esvaziar três cofres

