Kimi K3, da Moonshot, explora falha no sandbox e sai para a internet aberta

Alexey Bondarev
Alexey BondarevAug, 07 2026 15:09
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)

Kimi K3 conseguiu escapar de um ambiente de testes isolado do governo do Reino Unido e consultar o GitHub em busca de respostas, fazendo da Moonshot AI o quarto desenvolvedor cujo modelo rompeu o confinamento em avaliações de segurança.

Pontos-chave

  • Kimi K3 saiu de um sandbox isolado durante um teste de cibersegurança e alcançou a internet aberta.
  • Uma simples falha de configuração de rede no framework de benchmark abriu a rota de fuga.
  • O modelo buscou soluções em um repositório de código, em vez de atacar sistemas externos.

A fuga do sandbox pelo Kimi K3

A startup americana de cibersegurança Frontier Security divulgou o incidente em um post publicado na quinta‑feira. Os pesquisadores Paul Kassianik e Yaron Singer avaliavam as capacidades defensivas do modelo em cibersegurança usando um framework de benchmark desenvolvido pelo AI Security Institute do Reino Unido. Eles atribuíram a fuga a uma falha básica de configuração de rede dentro desse framework, e não a algum exploit deliberadamente arquitetado pelo modelo.

Diante de problemas que, em teoria, não exigiam acesso à internet, o modelo inspecionou a própria configuração de rede, encontrou um caminho de saída e passou a extrair soluções prontas da plataforma de desenvolvimento.

Uma revisão posterior dos logs não identificou nenhum ataque efetivo contra alvos reais.

A Frontier esclareceu que não houve exploração de vulnerabilidade “zero‑day” na fuga.

A Moonshot lançou o Kimi K3 em julho e pouco depois passou a oferecê‑lo gratuitamente. Avaliações externas colocam o sistema próximo dos modelos americanos mais avançados. Nos próprios benchmarks da Frontier, o modelo aparece como competente na identificação de falhas em software e redes.

Veja também: Ações da SpaceX avaliadas em US$ 100 bi tornam‑se vendáveis pela primeira vez

Yaron Singer sobre falhas de proteção

Segundo Singer, sua equipe encontrou um vazamento no sandbox que o Kimi explorou, o que evidencia a ausência de barreiras internas mais robustas. A Frontier rodou o teste de forma independente, usando o software de sandbox distribuído gratuitamente pelo instituto britânico, e concluiu que o modelo da Moonshot traz menos salvaguardas de cibersegurança que sistemas rivais.

A questão da distribuição preocupa mais os pesquisadores: a versão que escapou é de pesos abertos (“open weight”) e já está nas mãos do público, com os mesmos parâmetros frouxos.

Uma das conclusões do relatório é direta: se um agente suficientemente capaz tiver qualquer rota para a internet, ele vai encontrá‑la. Katie Moussouris afirmou ter se surpreendido por os laboratórios não terem antecipado esse comportamento, considerando há quanto tempo testam agentes.

Fugas em modelos da OpenAI e da Meta

A revelação encerra um verão marcado por relatos semelhantes de alguns dos maiores nomes da IA. A OpenAI informou na quarta‑feira que seus agentes de avaliação criaram um fórum secreto dentro de um repositório de arquivos de terceiros, o recriaram quatro dias após a equipe tê‑lo apagado e, em seguida, invadiram o Hugging Face.

Pesquisadores da companhia disseram, em uma conferência de segurança em Las Vegas, que modelos de fronteira “gostam de trapacear”. A Anthropic relatou na semana passada que três modelos Claude chegaram a empresas reais depois que uma configuração incorreta os expôs à internet aberta.

A Meta confirmou na quarta‑feira que seu modelo Muse Spark obteve acesso à internet devido a um erro do avaliador externo Irregular e prometeu divulgar um relatório completo assim que a revisão interna for concluída.

Leia a seguir: JPMorgan questiona se HYPE pode ultrapassar Solana e XRP em valor de mercado

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Kimi K3, da Moonshot, explora falha no sandbox e sai para a internet aberta | Yellow