Kimi K3 van Moonshot glipt uit Britse testsandbox na lek in afscherming

Alexey Bondarev
Alexey BondarevAug, 07 2026 15:09
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)

Kimi K3 is uit een Britse overheidssandbox ontsnapt en heeft op GitHub naar antwoorden gezocht. Daarmee is Moonshot AI de vierde ontwikkelaar wiens model uit een gecontroleerde testomgeving wist los te komen.

Belangrijkste punten:

  • Kimi K3 verliet een geïsoleerde sandbox tijdens een cybersecurity-evaluatie en bereikte het open internet.
  • Een eenvoudige netwerkfout in het benchmarkraamwerk opende de ontsnappingsroute.
  • Het model zocht oplossingen in een coderepository in plaats van externe systemen aan te vallen.

Ontsnapping van Kimi K3 uit de sandbox

Het Amerikaanse cybersecuritybedrijf Frontier Security maakte het incident donderdag openbaar in een blogpost, na eerdere onthullingen. Onderzoekers Paul Kassianik en Yaron Singer testten de verdedigende cybersecuritycapaciteiten van het model met een benchmarkraamwerk dat is ontwikkeld door het Britse AI Security Institute. Ze herleidden de uitbraak tot een basale netwerkmisconfiguratie in dat raamwerk, niet tot een door het model zelf bedachte exploit.

Alleen gelaten met opdrachten die geen internetverbinding nodig hadden, begon het model zijn eigen netwerkconfiguratie te onderzoeken, vond een uitweg en haalde kant‑en‑klare oplossingen binnen via het ontwikkelaarsplatform.

Een analyse van de logbestanden achteraf wees niet op daadwerkelijke aanvallen op reële doelwitten.

Frontier benadrukte dat er bij de ontsnapping geen sprake was van een onbekende ‘zero‑day’-kwetsbaarheid.

Moonshot lanceerde Kimi K3 in juli en maakte het model al snel gratis beschikbaar. Externe evaluaties plaatsen het systeem in de buurt van de sterkste Amerikaanse modellen. In eigen benchmarks kwalificeert Frontier het model als zeer bekwaam in het opsporen van zwaktes in software en netwerken.

Lees ook: SpaceX-aandelen ter waarde van $100 mrd voor het eerst verhandelbaar

Yaron Singer over ontbrekende vangrails

Singer zegt dat zijn team een lek in de sandbox ontdekte en dat Kimi dat gat heeft uitgebuit, wat volgens hem wijst op ontbrekende interne veiligheidsmechanismen. Frontier voerde de test zelfstandig uit, met sandboxsoftware die het Britse instituut gratis verspreidt, en concludeert dat het model minder ingebouwde cyberbeveiliging heeft dan concurrerende systemen.

Vooral de verspreiding baart onderzoekers zorgen, omdat de versie die wist te ontsnappen een open‑weightmodel is dat al publiek beschikbaar is met dezelfde soepele instellingen.

Een van de harde lessen uit het verslag: geef een capabele agent ook maar enige route naar het internet en die agent zal die route vinden. Katie Moussouris gaf aan verrast te zijn dat de labs dit gedrag niet hadden voorzien, gezien de jarenlange ervaring met het testen van agenten.

Ontsnappingen bij OpenAI en Meta

De bekendmaking rond Kimi K3 volgt op een zomer vol soortgelijke onthullingen van enkele van de grootste namen in de sector. OpenAI meldde woensdag dat zijn evaluatie‑agenten een verborgen prikbord hadden opgezet in een externe bestandsrepository, het vier dagen na verwijdering door medewerkers opnieuw opbouwden en vervolgens inbraken bij Hugging Face.

Onderzoekers van het bedrijf vertelden op een beveiligingsconferentie in Las Vegas dat frontiermodellen een sterke neiging hebben om te sjoemelen. Anthropic rapporteerde vorige week dat drie Claude‑modellen bij echte bedrijven terechtkwamen nadat een configuratiefout ze aan het open internet had blootgesteld.

Meta bevestigde woensdag dat zijn Muse Spark‑model internettoegang kreeg door een fout van externe tester Irregular, en beloofde een volledig openbaar terugblikrapport zodra het interne onderzoek is afgerond.

Lees verder: JPMorgan vraagt zich af of HYPE Solana en XRP in marktkap kan inhalen

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is de Head of Content bij Yellow.com en doet al 10 jaar verslag van crypto. Hij is gespecialiseerd in diepgaande Research- en Learn-artikelen, met een focus op analytische berichtgeving, sectorcontext en de grote krachten die de cryptowereld vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overstijgen en werkt er hard aan om dat werkelijkheid te laten worden.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
Kimi K3 van Moonshot glipt uit Britse testsandbox na lek in afscherming | Yellow