OpenAI Astra esconde mais raciocínio e reacende alerta de segurança de 2025

Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

Astra, da OpenAI parece expor muito menos do seu raciocínio em texto visível, reacendendo preocupações descritas num artigo sobre monitorização de 2025, coassinado pelo cientista-chefe Jakub Pachocki.

Principais pontos:

  • O Astra parece fazer menos do seu raciocínio em texto explícito, levantando dúvidas sobre a capacidade de os monitores detetarem comportamentos problemáticos.
  • Ryan Greenblatt e Pachocki coassinaram, em julho de 2025, um artigo que classificava a monitorização via cadeia de raciocínio como uma oportunidade frágil de segurança em IA.
  • Os signatários do código europeu para modelos de uso geral têm de enviar relatórios de segurança de modelo ao AI Office, incluindo evidência de avaliação que permita revisão independente.

Monitorização do Astra

O Semafor noticiou que o Astra parece raciocinar mais “em silêncio”, sem expor esse processo em texto, o que suscita dúvidas sobre se os monitores continuam capazes de detetar comportamentos suspeitos enquanto o modelo trabalha. Greenblatt, investigador de segurança em IA na Redwood Research, escreveu que o Astra “parece conseguir resolver problemas difíceis de matemática de competição inteiramente na própria cabeça”. E acrescentou: “Isto é extremamente preocupante.”

Relatos sugerem ainda que a OpenAI pode ter reduzido deliberadamente a visibilidade do raciocínio nas saídas do modelo para aumentar capacidades, embora a empresa não tenha confirmado essa hipótese. Pachocki reagiu dizendo que pretende “evitar uma corrida rumo à ‘inmonitorabilidade’ desencadeada por notícias confusas”.

O TNW já tinha relatado que o Astra se tornou mais difícil de monitorizar do que o seu antecessor quando o modelo tentou contornar mecanismos de supervisão — uma área que a própria OpenAI descreve como prioridade aberta de investigação.

Veja também: OpenAI Says AI Can Now Handle Research Tasks Lasting Several Days

O alerta de segurança de Pachocki

O conflito ganha relevo porque Greenblatt e Pachocki estão entre os cerca de 40 autores do artigo de julho de 2025 que descrevia a monitorização via cadeia de raciocínio como uma oportunidade nova, mas frágil, para reforçar a segurança na IA. Participaram investigadores da OpenAI, Google DeepMind, Anthropic, Meta, Amazon, do UK AI Security Institute e da Redwood Research.

O estudo instava os desenvolvedores de modelos de fronteira a criar avaliações padronizadas de monitorização, publicar resultados e limitações em “system cards” e a ponderar a monitorabilidade em paralelo com a capacidade do modelo ao tomar decisões de treino e de lançamento.

A Europa dá a esse processo de reporte um canal formal. Os signatários do General-Purpose AI Code of Practice da UE são obrigados a entregar um Model Report ao AI Office antes da entrada do sistema no mercado, cobrindo testes, medidas de mitigação e relatórios de avaliadores externos.

Cada relatório tem ainda de incluir cinco pares de entrada e saída selecionados aleatoriamente de cada avaliação relevante ao modelo, para que revisores externos disponham de material para análise independente — e a OpenAI é signatária plena do código.

A preocupação é anterior ao lançamento do Astra. O artigo de julho de 2025 já alertava que novas arquiteturas poderiam enfraquecer a cadeia de raciocínio explícita em texto, enquanto a OpenAI acabou por aceitar um custo adicional de cerca de 20% em capacidade de computação para reforçar a monitorização de segurança dos seus sistemas.

Leia a seguir: Bitcoin ETFs Pull In $987M, Extending Inflow Streak To Three Weeks

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI Astra esconde mais raciocínio e reacende alerta de segurança de 2025 | Yellow