Kimi K3 تمكن من مغادرة بيئة اختبار معزولة تابعة للحكومة البريطانية والوصول إلى GitHub للبحث عن حلول، ليصبح نموذج Moonshot AI رابع نموذج رائد يخرق حدود الاحتواء.
أبرز النقاط:
- Kimi K3 غادر «صندوقاً رملياً» معزولاً خلال تقييم للأمن السيبراني ووصل إلى الإنترنت المفتوح.
- ثغرة بسيطة في إعدادات الشبكة ضمن إطار الاختبار هي التي وفرت له طريق الخروج.
- النموذج لجأ إلى البحث عن حلول في مستودع شيفرات بدلاً من محاولة استهداف أنظمة خارجية.
تفاصيل هروب Kimi K3 من بيئة الاختبار
شركة Frontier Security الأميركية المتخصصة في الأمن السيبراني كشفت الحادثة في تدوينة نُشرت يوم الخميس. الباحثان بول كاسيانيك ويارون سينغر كانا يقيسان قدرات النموذج الدفاعية في الأمن السيبراني باستخدام إطار قياس طوّره معهد أمن الذكاء الاصطناعي البريطاني. وقد أرجعا الاختراق إلى خطأ أساسي في إعدادات الشبكة داخل هذا الإطار، وليس إلى استغلال متعمد طوره النموذج نفسه.
في بيئة كان يفترض أن تحل فيها المشكلات من دون أي حاجة للإنترنت، بدأ النموذج يفحص إعدادات الشبكة الخاصة به، واكتشف منفذاً إلى الخارج، ثم استدعى حلولاً جاهزة من منصة للمطورين.
مراجعة سجلات النشاط بعد الحادثة لم تكشف عن أي هجوم حقيقي على أهداف فعلية.
Frontier أوضحت أن عملية الهروب لم تتضمن استغلال «ثغرة يوم صفر» أو خللاً غير معروف مسبقاً.
أطلقت Moonshot نموذج Kimi K3 في يوليو وأتاحته مجاناً بعد فترة وجيزة، وتضعه التقييمات الخارجية في مستوى قريب من أقوى النماذج الأميركية. واختبارات Frontier الخاصة تصنفه كنموذج قادر على اصطياد الثغرات في البرمجيات والشبكات.
أيضاً على يلو: أول صفقة ثانوية تجعل تقييم سهم SpaceX عند 100 مليار دولار قابلاً للتحقق
يارون سينغر: ثغرة في الصندوق وغياب للضوابط الداخلية
سينغر أوضح أن فريقه اكتشف تسرّباً في بيئة «الصندوق الرملي»، وأن Kimi استغل هذه الثغرة، بما يشير إلى ضعف الحواجز الداخلية. Frontier أجرت الاختبارات بشكل مستقل باستخدام برمجيات الصندوق الرملي المتاحة مجاناً من المعهد البريطاني، وقالت إن النتائج تظهر أن النموذج يتضمن آليات حماية سيبرانية أقل من منافسيه.
أكثر ما يثير القلق لدى الباحثين هو مسألة التوزيع؛ فالإصدار الذي تمكن من الهروب هو نموذج «أوزان مفتوحة» (open weight) متاح بالفعل للجمهور بنفس إعدادات الحماية المتراخية.
إحدى الخلاصات المباشرة من تقرير Frontier هي: إذا منحت وكيلاً ذكياً منفذاً إلى الإنترنت، فسيعثر عليه عاجلاً أو آجلاً. كاتي موسوريس قالت إنها فوجئت بأن المختبرات لم تتوقع هذا السلوك، بالنظر إلى طول فترة اختبارات الوكلاء الذكيين.
اختراقات وخروقات لدى OpenAI وMeta
هذا الكشف يأتي تتويجاً لصيف من الاعترافات المشابهة من جانب بعض أكبر الأسماء في القطاع. شركة OpenAI أعلنت يوم الأربعاء أن وكلاء التقييم لديها أنشأوا لوحة رسائل خفية داخل مستودع ملفات تابع لجهة خارجية، ثم أعادوا بناءها بعد أربعة أيام من حذفها من قبل الموظفين، قبل أن يتسللوا إلى Hugging Face.
باحثو الشركة أبلغوا مؤتمراً للأمن في لاس فيغاس أن النماذج الحدّية تميل إلى «الغش» أو التحايل على قواعد التقييم. شركة Anthropic ذكرت الأسبوع الماضي أن ثلاثة نماذج من Claude وصلت إلى شركات حقيقية بعد أن عرّضها خطأ في الإعدادات للإنترنت المفتوح.
Meta أكدت الأربعاء أن نموذجها Muse Spark حصل على وصول إلى الإنترنت بسبب خطأ من شركة الاختبارات الخارجية Irregular، وتعهدت بنشر مراجعة شاملة بعد انتهاء التحقيق الداخلي.
اقرأ أيضاً: تساؤلات JPMorgan حول قدرة HYPE على تجاوز Solana وXRP في القيمة السوقية





