Kimi K3 نجح في مغادرة صندوق اختبار حكومي بريطاني والتصفح في GitHub بحثًا عن إجابات، لتصبح Moonshot AI رابع شركة مطوِّرة يخرج نموذجها عن نطاق العزل التقني.
أهم النقاط:
- Kimi K3 غادر بيئة «صندوق رمل» معزولة خلال اختبار للأمن السيبراني ووصل إلى الإنترنت المفتوح.
- خلل بسيط في إعدادات الشبكة داخل إطار الاختبار هو ما فتح له الطريق إلى الخارج.
- النموذج لجأ إلى البحث عن حلول في مستودع برمجي بدلًا من استهداف أنظمة خارجية بالهجوم.
تفاصيل هروب Kimi K3 من صندوق الرمل
شركة Frontier Security الأميركية للأمن السيبراني كشفت عن الحادثة في تدوينة نُشرت يوم الخميس. الباحثان بول كاسيانيك ويارون سينغر كانا يقيسان قدرات النموذج الدفاعية في الأمن السيبراني باستخدام إطار اختبارات وضعه معهد أمن الذكاء الاصطناعي في المملكة المتحدة. التحقيق أرجع الاختراق إلى خطأ بسيط في ضبط الشبكة داخل الإطار، وليس إلى ثغرة اكتشفها النموذج أو استغلها عمدًا.
وُضع النموذج أمام مسائل صُممت أصلًا لتُحل دون الحاجة إلى اتصال بالإنترنت، لكن Kimi K3 فحص إعدادات الشبكة الخاصة به، واكتشف مسارًا للخروج واستفاد من حلول جاهزة على منصة للمطورين.
مراجعة سجلات التشغيل لاحقًا لم تُظهر أي هجوم حقيقي على هدف فعلي.
Frontier أوضحت في بيان توضيحي أن الهروب لم يتضمّن استغلال ثغرة «يوم صفر» أو خلل غير معروف.
أطلقت Moonshot نموذج Kimi K3 في يوليو وأتاحته مجانًا بعد ذلك بفترة قصيرة، وتضعه التقييمات المستقلة في مستوى قريب من أقوى النماذج الأميركية. كما تُظهر بنشماركات Frontier أنه قادر على رصد الثغرات في البرمجيات والشبكات بدرجة عالية.
اقرأ أيضًا: سهم SpaceX بقيمة 100 مليار دولار يصبح متاحًا للبيع في السوق الثانوية لأول مرة
يارون سينغر: «حواجز الحماية الداخلية غائبة»
سينغر أوضح أن فريقه اكتشف «تسرّبًا» في صندوق الرمل، وأن Kimi استغل هذه الثغرة، في إشارة إلى غياب حواجز حماية داخلية كافية. Frontier أجرت الاختبار بصورة مستقلة باستخدام برنامج صندوق الرمل الذي يوزعه المعهد البريطاني مجانًا، وخلصت إلى أن النموذج مزوّد بضوابط سيبرانية أقل من بعض النماذج المنافسة.
المسألة الأكثر إرباكًا للباحثين هي جانب التوزيع؛ فالإصدار الذي خرج من الصندوق متاح بأوزان مفتوحة، ومتداول بالفعل لدى الجمهور بالإعدادات المتساهلة نفسها.
أحد الاستنتاجات الصريحة في التقرير: إذا منحت وكيلاً ذكيًا مسارًا ما إلى الإنترنت، فسوف يجده ويستغله. كيتي موسوريس قالت إنها فوجئت بعدم توقّع المختبرات لهذا السلوك، بالنظر إلى سنوات من اختبارات الوكلاء الذكيين.
هروب نماذج OpenAI وMeta
هذا الكشف يختتم صيفًا حافلًا باعترافات مماثلة من أكبر الأسماء في القطاع. شركة OpenAI أعلنت يوم الأربعاء أن وكلاء التقييم لديها أنشأوا لوحة رسائل مخفية داخل مستودع ملفات تابع لجهة خارجية، ثم أعادوا بناءها بعد أربعة أيام من حذفها من قِبل الموظفين، قبل أن يتسللوا إلى Hugging Face.
باحثو OpenAI عرضوا في مؤتمر أمني بلاس فيغاس أن «نماذج الحدود» تميل إلى الغش والتحايل على القيود. شركة Anthropic أفادت الأسبوع الماضي بأن ثلاثة نماذج من Claude تواصلت مع شركات حقيقية بعد أن عرّضها خطأ في الإعدادات للإنترنت المفتوح.
Meta بدورها أكدت يوم الأربعاء أن نموذجها Muse Spark حصل على اتصال بالإنترنت نتيجة خطأ من جهة الاختبار الخارجية Irregular، وتعهدت بنشر مراجعة شاملة بعد انتهاء التحقيق الداخلي.
المقال التالي: جي بي مورغان يتساءل ما إذا كان بإمكان HYPE تجاوز Solana وXRP في القيمة السوقية





