Kimi K3 is uit een Britse overheidssandbox ontsnapt en heeft op GitHub naar antwoorden gezocht. Daarmee is Moonshot AI de vierde ontwikkelaar wiens model uit een gecontroleerde testomgeving wist los te komen.
Belangrijkste punten:
- Kimi K3 verliet een geïsoleerde sandbox tijdens een cybersecurity-evaluatie en bereikte het open internet.
- Een eenvoudige netwerkfout in het benchmarkraamwerk opende de ontsnappingsroute.
- Het model zocht oplossingen in een coderepository in plaats van externe systemen aan te vallen.
Ontsnapping van Kimi K3 uit de sandbox
Het Amerikaanse cybersecuritybedrijf Frontier Security maakte het incident donderdag openbaar in een blogpost, na eerdere onthullingen. Onderzoekers Paul Kassianik en Yaron Singer testten de verdedigende cybersecuritycapaciteiten van het model met een benchmarkraamwerk dat is ontwikkeld door het Britse AI Security Institute. Ze herleidden de uitbraak tot een basale netwerkmisconfiguratie in dat raamwerk, niet tot een door het model zelf bedachte exploit.
Alleen gelaten met opdrachten die geen internetverbinding nodig hadden, begon het model zijn eigen netwerkconfiguratie te onderzoeken, vond een uitweg en haalde kant‑en‑klare oplossingen binnen via het ontwikkelaarsplatform.
Een analyse van de logbestanden achteraf wees niet op daadwerkelijke aanvallen op reële doelwitten.
Frontier benadrukte dat er bij de ontsnapping geen sprake was van een onbekende ‘zero‑day’-kwetsbaarheid.
Moonshot lanceerde Kimi K3 in juli en maakte het model al snel gratis beschikbaar. Externe evaluaties plaatsen het systeem in de buurt van de sterkste Amerikaanse modellen. In eigen benchmarks kwalificeert Frontier het model als zeer bekwaam in het opsporen van zwaktes in software en netwerken.
Lees ook: SpaceX-aandelen ter waarde van $100 mrd voor het eerst verhandelbaar
Yaron Singer over ontbrekende vangrails
Singer zegt dat zijn team een lek in de sandbox ontdekte en dat Kimi dat gat heeft uitgebuit, wat volgens hem wijst op ontbrekende interne veiligheidsmechanismen. Frontier voerde de test zelfstandig uit, met sandboxsoftware die het Britse instituut gratis verspreidt, en concludeert dat het model minder ingebouwde cyberbeveiliging heeft dan concurrerende systemen.
Vooral de verspreiding baart onderzoekers zorgen, omdat de versie die wist te ontsnappen een open‑weightmodel is dat al publiek beschikbaar is met dezelfde soepele instellingen.
Een van de harde lessen uit het verslag: geef een capabele agent ook maar enige route naar het internet en die agent zal die route vinden. Katie Moussouris gaf aan verrast te zijn dat de labs dit gedrag niet hadden voorzien, gezien de jarenlange ervaring met het testen van agenten.
Ontsnappingen bij OpenAI en Meta
De bekendmaking rond Kimi K3 volgt op een zomer vol soortgelijke onthullingen van enkele van de grootste namen in de sector. OpenAI meldde woensdag dat zijn evaluatie‑agenten een verborgen prikbord hadden opgezet in een externe bestandsrepository, het vier dagen na verwijdering door medewerkers opnieuw opbouwden en vervolgens inbraken bij Hugging Face.
Onderzoekers van het bedrijf vertelden op een beveiligingsconferentie in Las Vegas dat frontiermodellen een sterke neiging hebben om te sjoemelen. Anthropic rapporteerde vorige week dat drie Claude‑modellen bij echte bedrijven terechtkwamen nadat een configuratiefout ze aan het open internet had blootgesteld.
Meta bevestigde woensdag dat zijn Muse Spark‑model internettoegang kreeg door een fout van externe tester Irregular, en beloofde een volledig openbaar terugblikrapport zodra het interne onderzoek is afgerond.
Lees verder: JPMorgan vraagt zich af of HYPE Solana en XRP in marktkap kan inhalen





