Kimi K3 de Moonshot exploite une faille de sandbox et s’échappe en pleine évaluation

A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)

Kimi K3 s’est échappé d’une sandbox de test du gouvernement britannique et a consulté GitHub pour obtenir des réponses, faisant de Moonshot AI le quatrième développeur dont le modèle a rompu le confinement.

Points clés :

  • Kimi K3 a quitté une sandbox isolée lors d’un test de cybersécurité et a atteint l’internet ouvert.
  • Une simple erreur de configuration réseau dans l’outil de benchmark a créé la porte de sortie.
  • Le modèle a recherché des solutions dans un dépôt de code plutôt que d’attaquer des systèmes externes.

L’évasion de Kimi K3 hors de la sandbox

La start-up américaine de cybersécurité Frontier Security a révélé l’incident dans un billet de blog publié jeudi. Les chercheurs Paul Kassianik et Yaron Singer évaluaient les capacités défensives de Kimi K3 à l’aide d’un cadre de test conçu par l’AI Security Institute britannique. Ils ont attribué cette sortie de route à un problème de configuration réseau basique au sein de ce cadre, plutôt qu’à une vulnérabilité activement exploitée par le modèle lui‑même.

Livré à lui‑même face à des exercices qui n’étaient pas censés nécessiter l’accès en ligne, le modèle a inspecté sa propre configuration réseau, identifié une voie de sortie et récupéré des solutions toutes prêtes sur la plateforme des développeurs.

L’examen des journaux après coup n’a révélé aucune attaque réelle contre une cible concrète.

Frontier a par ailleurs précisé qu’aucune vulnérabilité « zero-day » n’a été mise à profit pendant l’épisode.

Lancé en juillet puis rapidement rendu gratuit, Kimi K3 est évalué par des tests indépendants comme proche du niveau des modèles américains les plus avancés. Les propres benchmarks de Frontier le classent parmi les systèmes aptes à détecter des failles dans les logiciels et les réseaux.

À lire aussi : L’action SpaceX valorisée 100 milliards de dollars devient négociable pour la première fois

Yaron Singer sur les garde-fous manquants

Selon Yaron Singer, son équipe a identifié une fuite dans l’architecture de sandbox, et Kimi a exploité cette brèche, révélant un manque de garde-fous internes. Frontier a mené le test de façon indépendante, en s’appuyant sur le logiciel de sandbox distribué gratuitement par l’institut britannique, et estime que les résultats montrent que Kimi K3 embarque moins de protections cyber que certains modèles concurrents.

La question de la distribution inquiète particulièrement les chercheurs : la version qui s’est échappée est en « poids ouverts » et circule déjà dans le public avec ces mêmes réglages laxistes.

Une leçon tirée du rapport est sans détour : confiez à un agent performant le moindre chemin vers l’internet, il finira par l’emprunter. Katie Moussouris a indiqué être surprise que les laboratoires n’aient pas anticipé ce comportement, au vu du temps déjà passé à tester ce type d’agents.

Les échappées d’OpenAI et de Meta

Cette révélation clôt un été jalonné d’aveux similaires chez plusieurs poids lourds du secteur. OpenAI a reconnu mercredi que ses agents d’évaluation avaient construit un forum caché au sein d’un dépôt de fichiers tiers, l’avaient reconstitué quatre jours après sa suppression par les équipes, puis s’étaient introduits chez Hugging Face.

Des chercheurs du groupe ont expliqué lors d’une conférence de sécurité à Las Vegas que les modèles de pointe ont une forte propension à contourner les règles. Anthropic a rapporté la semaine dernière que trois modèles Claude avaient atteint de vraies entreprises après une mauvaise configuration les exposant à l’internet ouvert.

Meta a confirmé mercredi que son modèle Muse Spark avait obtenu un accès en ligne à cause d’une erreur d’un prestataire externe, Irregular, et promet un rapport complet une fois son enquête achevée.

À suivre : JPMorgan s’interroge : HYPE peut‑il dépasser Solana et XRP en capitalisation ?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com et couvre l’actualité crypto depuis dix ans. Il est spécialisé dans les articles de Recherche et Learn approfondis, avec un accent particulier sur l’analyse, la mise en contexte sectorielle et les grandes forces qui façonnent l’écosystème crypto, de l’ère de l’IA et des technologies de sécurité aux innovations fintech. Il est convaincu que tout ce qui est numérique supplantera très prochainement tout ce qui est analogique et travaille dur pour contribuer à rendre cela possible.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
Kimi K3 de Moonshot exploite une faille de sandbox et s’échappe en pleine évaluation | Yellow