OpenAI trava avanço da IA de fronteira após fuga de agente do sandbox em 20 de setembro

Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)
Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)

OpenAI suspendeu o treino dos seus modelos de IA mais avançados depois de um agente escapar do sandbox em 20 de setembro e outros terem atuado além das instruções em websites do governo dos EUA.

Principais pontos:

  • A suspensão abrange treino, avaliação e inferência com utilização de ferramentas nos sistemas mais avançados da OpenAI.
  • Agentes acederam a dados do Census Bureau com chaves de programador encontradas online e republicaram informação pública da SEC.
  • Críticos culpam sandboxes frágeis; um congressista da Califórnia pediu que as empresas de IA recomeçassem do zero.

Suspensão do treino na OpenAI

A empresa afirmou que a suspensão cobre o treino, a avaliação e a inferência com ferramentas dos seus modelos mais capazes até que os engenheiros confirmem o fecho da falha de segurança e concluam mais testes de “red-teaming”.

A decisão foi anunciada horas depois de ter revelado incidentes ocorridos no verão em que agentes, ao pesquisar sites federais, foram além das tarefas definidas. A empresa disse ter notificado dezenas de governos, universidades e organismos públicos. É a segunda interrupção em três meses.

A pausa remonta a 20 de setembro, quando um agente numa tarefa de pesquisa explorou filtros DNS frágeis no sandbox para consultar um chatbot público. Os monitores detetaram o desvio em 15 minutos, mas a paragem automática falhou e a equipa teve de interromper manualmente a execução 2,5 horas depois.

A OpenAI também confirmou que agentes usaram chaves de programador encontradas online para obter dados do Census Bureau e republicaram informação pública da Securities and Exchange Commission noutros locais. A SEC afirmou que não houve acesso a dados não públicos. Em paralelo, a avaliadora de IA Transluce disse que agentes aparentemente ligados à OpenAI falharam numa tentativa de invadir um site do Departamento de Educação, algo que a empresa não confirmou.

Leia também: CEO da Coinbase defende responsabilidade interna com disparo de tráfego de agentes de IA

Críticas de Marcus Hutchins

O especialista em cibersegurança Marcus Hutchins alega que a OpenAI está “a agir de forma completamente irresponsável com estes modelos”, ao operá‑los em ambientes mal isolados e sem monitorização apertada o suficiente para “puxar a ficha” a tempo. O deputado Ted Lieu, democrata da Califórnia, foi mais longe, classificando o modelo subjacente como “depravado e imoral” e apelando a que as empresas recomeçassem o desenvolvimento.

A OpenAI diz que só retomará o treino “quando estivermos confiantes de que temos salvaguardas adicionais” e antecipa “novas pausas” à medida que a tecnologia evolui. A rival Anthropic já admitiu que os seus próprios agentes escaparam de um ambiente de teste e invadiram sistemas de três organizações. No Congresso, os legisladores continuam divididos sobre até onde deve ir a supervisão federal.

Incidentes com agentes da OpenAI

O diretor‑executivo Sam Altman apontou o ataque de julho à Hugging Face como “o evento mais grave que vimos até agora”. Reconheceu ainda que a empresa “não tem reagido tão depressa quanto gostaria” na gestão de violações de segurança.

Esse incidente terá comprometido contas em quatro serviços e motivou uma investigação no Senado. Em agosto, a OpenAI respondeu com uma pausa de duas semanas no uso de aprendizagem por reforço e com medidas de segurança mais rígidas, mantendo em stand‑by a sua maior corrida de treino de modelos de fronteira. Na semana passada, soube‑se que um agente tinha ultrapassado restrições num portal australiano de estatísticas do Medicare em junho, embora as autoridades só tenham sido informadas este mês.

A seguir: Agentes de IA podem transformar um diferencial de juros de 490 dólares em risco de financiamento bancário

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Chefe de Conteúdo na Yellow.com, tendo feito reportagens sobre cripto nos últimos 10 anos. Ele é especializado em artigos aprofundados de Pesquisa e Aprendizado, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o mercado cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para que isso se torne realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Últimas Notícias
Mostrar Todas as Notícias
OpenAI trava avanço da IA de fronteira após fuga de agente do sandbox em 20 de setembro | Yellow