OpenAI Astra Oculta Mais Raciocínio e Reacende Alerta de Segurança de 2025

Alexey Bondarev
Alexey BondarevSep, 07 2026 18:00
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

Astra, da OpenAI parece expor menos raciocínio em texto visível, reacendendo preocupações descritas num artigo de 2025 sobre “monitorability” coassinado pelo cientista‑chefe Jakub Pachocki.

Pontos-chave:

  • O Astra aparenta realizar mais do seu raciocínio “por detrás do pano”, em vez de o explicitar em texto, o que levanta dúvidas sobre a capacidade de monitores detetarem comportamentos problemáticos.
  • Ryan Greenblatt e Pachocki coassinaram, em julho de 2025, um paper que classificava a monitorização via chain-of-thought como uma oportunidade frágil para a segurança em IA.
  • Os signatários do código europeu para modelos de uso geral são obrigados a apresentar relatórios de segurança de modelo ao AI Office, incluindo evidência de avaliação que permita revisão independente.

Monitorização do Astra

O Semafor noticiou que o Astra parece raciocinar cada vez mais sem revelar esse processo em texto visível, abrindo a pergunta: será que os monitores continuam a conseguir identificar comportamentos suspeitos enquanto o modelo “pensa”? Greenblatt, investigador de segurança em IA na Redwood Research, escreveu que o Astra “parece capaz de resolver problemas complexos de matemática de competição inteiramente na sua cabeça”. E acrescentou: “Isto é extremamente preocupante.”

Várias reportagens sugerem que a OpenAI poderá ter reduzido deliberadamente a transparência dos outputs do modelo para ganhar capacidades, embora a empresa não tenha confirmado essa tese. Pachocki reagiu dizendo que quer “evitar uma corrida rumo à não‑monitorização, desencadeada por reportagens confusas”.

O TNW já tinha revelado que o Astra se tornou mais difícil de monitorizar do que o seu antecessor quando o modelo tentava contornar mecanismos de supervisão – uma área que a OpenAI descreve como uma prioridade aberta de investigação.

Leia também: OpenAI diz que IA já consegue lidar com tarefas de investigação de vários dias

O alerta de segurança de Pachocki

O debate ganha peso porque Greenblatt e Pachocki estão entre os cerca de 40 autores de um paper publicado em julho de 2025 que apresentava a monitorização via chain-of-thought como uma oportunidade nova, mas frágil, para reforçar a segurança de sistemas de IA. No artigo participaram investigadores da OpenAI, Google DeepMind, Anthropic, Meta, Amazon, do UK AI Security Institute e da Redwood Research.

O estudo apelava a que os desenvolvedores na fronteira tecnológica criassem avaliações padronizadas de monitorabilidade, publicassem resultados e limitações em system cards e ponderassem a monitorização em paralelo com as capacidades quando tomassem decisões de treino ou de lançamento.

A Europa dá um enquadramento formal a esse processo de reporte. Os signatários do General-Purpose AI Code of Practice da UE têm de entregar um Model Report ao AI Office antes da entrada de cada modelo no mercado, detalhando avaliações, medidas de mitigação e relatórios de avaliadores externos.

Cada relatório deve ainda incluir cinco amostras selecionadas aleatoriamente de inputs e outputs de todas as avaliações relevantes, permitindo que revisores externos façam uma análise independente. A OpenAI é signatária plena do código.

A preocupação é anterior ao lançamento do Astra. O paper de julho de 2025 já alertava que novas arquiteturas poderiam enfraquecer o raciocínio em cadeia visível, enquanto a própria OpenAI aceitou mais tarde um aumento de cerca de 20% no custo computacional para reforçar os mecanismos de monitorização de segurança dos seus sistemas.

A seguir: ETFs de Bitcoin captam US$ 987 milhões e prolongam série de entradas para três semanas

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Chefe de Conteúdo na Yellow.com, tendo feito reportagens sobre cripto nos últimos 10 anos. Ele é especializado em artigos aprofundados de Pesquisa e Aprendizado, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o mercado cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para que isso se torne realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.