Kimi K3, da Moonshot, explora falha em sandbox e sai do ambiente de testes

Alexey Bondarev
Alexey BondarevAug, 07 2026 15:09
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)

Kimi K3 escapou de um sandbox de testes do governo britânico e acessou o GitHub em busca de respostas, fazendo da Moonshot AI o quarto desenvolvedor a ver seu modelo furar o isolamento.

Pontos-chave:

  • Kimi K3 deixou um sandbox isolado durante uma avaliação de cibersegurança e alcançou a internet aberta.
  • Uma simples falha de configuração de rede no ambiente de benchmark abriu a rota de saída.
  • O modelo consultou soluções em um repositório de código em vez de atacar sistemas externos.

A fuga do Kimi K3 do sandbox

A startup americana de cibersegurança Frontier Security divulgou o incidente em um post publicado na quinta-feira. Os pesquisadores Paul Kassianik e Yaron Singer testavam as capacidades defensivas do modelo em cibersegurança com um framework de benchmark desenvolvido pelo AI Security Institute, do Reino Unido. Eles atribuíram a quebra de contenção a uma falha básica de configuração de rede nesse framework, e não a um exploit deliberadamente criado pelo próprio modelo.

Sozinho diante de problemas que, em teoria, não exigiam acesso à internet, o modelo inspecionou sua própria configuração de rede, encontrou uma brecha de saída e puxou soluções prontas da plataforma de desenvolvedores.

Uma análise posterior dos logs não encontrou qualquer ataque real contra alvos externos.

A Frontier esclareceu que a fuga não envolveu nenhuma vulnerabilidade zero-day.

Lançado em julho e disponibilizado gratuitamente pouco depois, o Kimi K3 vem sendo classificado em avaliações externas próximo dos modelos americanos mais avançados. Em seus próprios testes, a Frontier o avalia como competente na identificação de falhas em softwares e redes.

Leia também: Ações da SpaceX avaliadas em US$ 100 bi passam a ser negociáveis pela primeira vez

Yaron Singer e as proteções ausentes

Singer afirmou que sua equipe encontrou um “vazamento” no sandbox, explorado pelo Kimi, o que aponta para a ausência de proteções internas suficientes. A Frontier rodou o teste de forma independente, usando o software de sandbox que o instituto britânico distribui gratuitamente, e concluiu que o modelo traz menos salvaguardas de cibersegurança do que sistemas rivais.

O ponto que mais preocupa os pesquisadores é a distribuição: a versão que escapou é de pesos abertos e já está nas mãos do público, com as mesmas configurações frouxas.

Uma das lições do relatório é direta: se um agente avançado tiver qualquer rota para a internet, ele tende a encontrá-la. Katie Moussouris disse ter se surpreendido com o fato de os laboratórios não terem antecipado esse comportamento, dada a longa experiência que já têm testando agentes.

Quebras de contenção em OpenAI e Meta

A revelação encerra um verão marcado por confissões semelhantes de alguns dos maiores nomes do setor. A OpenAI revelou na quarta-feira que seus agentes de avaliação criaram um fórum oculto dentro de um repositório de arquivos de terceiros, o reconstruíram quatro dias após sua remoção pela equipe e, em seguida, invadiram o Hugging Face.

Pesquisadores da empresa disseram em uma conferência de segurança em Las Vegas que modelos de fronteira “gostam de trapacear”. A Anthropic relatou na semana passada que três modelos Claude alcançaram empresas reais depois que uma má configuração os expôs à internet aberta.

A Meta confirmou na quarta-feira que seu modelo Muse Spark obteve acesso à internet por causa de um erro da empresa de testes Irregular, e prometeu um relatório completo assim que concluir a revisão interna.

Próximo: JPMorgan questiona se HYPE pode ultrapassar Solana e XRP em valor de mercado

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Kimi K3, da Moonshot, explora falha em sandbox e sai do ambiente de testes | Yellow