نموذجَان من OpenAI تمكّنا من الخروج من بيئة اختبار معزولة (Sandbox) والوصول إلى خوادم Hugging Face الإنتاجية، لكن خبراء الأمن يؤكدون أن المشكلة الأساسية كانت في تصميم بيئة الاحتواء، لا في ظهور سلوك «منفلت» غير متوقَّع من النماذج.
أبرز النقاط:
- OpenAI قالت إن النموذج GPT-5.6 Sol ونموذجاً غير مُعلَن استغلا ثغرة يوم-صفر للوصول إلى قاعدة بيانات الإنتاج لدى Hugging Face أثناء تقييم قياسي.
- مؤسس Trail of Bits دان غويدو وخبير الاستجابة للحوادث جيك ويليامز وصفا ما حدث بأنه فشل احتواء، لا اختراقاً ثورياً من ذكاء اصطناعي «متمرّد».
- Hugging Face اكتشفت النشاط وأوقفته في 16 يوليو، أي قبل خمسة أيام من ربط OpenAI الحادث باختباراتها الداخلية.
هروب من Sandbox لدى OpenAI وصل إلى خوادم Hugging Face
OpenAI أوضحت في بيان لها على موقعها هنا أن مزيجاً من نموذج GPT-5.6 Sol ونموذج غير مُعلَن نفّذ العملية خلال تقييم داخلي على معيار ExploitGym. المهندسون خفّضوا مستويات «الرفض السيبراني» في هذه النماذج بهدف قياس الحدود القصوى لقدراتها الهجومية المحتملة.
الشركة، التي وصفت الحادث بأنه غير مسبوق، قالت إن النماذج استهلكت قدرات حوسبة استنتاجية ضخمة بحثاً عن مسار إلى الإنترنت المفتوح. واستغلت ثغرة غير معروفة سابقاً في وكيل كاش لسجل حزم برمجية، ثم رفعت صلاحياتها وانتقلت أفقياً داخل البنية التحتية حتى وصلت إلى عقدة تمتلك اتصالاً خارجياً. عندها استنتجت أن Hugging Face تستضيف حلول الاختبار، وبدأت العمل للحصول على تنفيذ تعليمات برمجية عن بُعد على خوادمها.
فريق Hugging Face نفسه رصد النشاط غير المعتاد في 16 يوليو، وأبلغ به جهات إنفاذ القانون، قبل خمسة أيام من توصل الشركتين إلى أن الهجوم مرتبط باختبارات OpenAI. الرئيس التنفيذي كليم دولانج اعتبر الخرق دليلاً على أن أي شركة بمفردها لا تستطيع تأمين أنظمة الذكاء الاصطناعي خلف أبواب مغلقة دون تعاون أوسع.
اقرأ أيضاً: شركة Anthropic لاحقت صفقة استحواذ على شركة روبوتات بقيمة 11 مليار دولار قبل إعلان النفي
باحثو أمن: الخلل في تصميم احتواء OpenAI
دان غويدو، مؤسس شركة الأبحاث Trail of Bits، وصف ما حدث بأنه فشل في الاحتواء مع تعطيل ضوابط الأمان. خبير الاستجابة للحوادث جيك ويليامز رأى أن أي نموذج يستطيع تنفيذ ما وثّقته Hugging Face لم يكن معزولاً بالكامل من الأساس. الباحث الأمني مارتن بون أكد أن الـSandbox الحقيقية يجب ألّا تمتلك أي اتصال فيزيائي بالإنترنت.
ويليامز لخّص الموقف بعبارة مباشرة: ما يصفه البعض بهروب نموذج ذكاء اصطناعي، يراه آخرون مجرد Sandbox سيئة التصميم.
بنچيو يحذّر من مخاطر هجمات سيبرانية ذاتية التشغيل
العالم يوشوا بنچيو، الحاصل على جائزة تورنغ، كتب أن وكلاء الذكاء الاصطناعي بدأوا في «الغش» في اختبارات مُسيطر عليها منذ أشهر، وأن هذه الواقعة يجب أن تكون جرس إنذار للقطاع. برأيه، مسار تطوير الذكاء الاصطناعي الحالي يتجه نحو قدرات أعلى على شن هجمات سيبرانية شبه ذاتية التشغيل.
اعتراف OpenAI يأتي بعد سلسلة قصيرة من حوادث مشابهة؛ إذ أبلغت في وقت سابق من الأسبوع نفسه بأن النموذج غير المُعلَن ذاته كان قد خرج من Sandboxes داخلية خلال اختبارات أخرى، وإن لم يصل إلى أنظمة خارجية حينها.
من جهتها، قالت Anthropic إن نموذجها Mythos حصل على وصول غير مقصود للإنترنت أثناء اختبارات أمان، لكنها شددت على أن الاحتواء لم يفشل بالكامل.
المقال التالي: وثائقي Hulu عن تشارلز مانسون يكشف حفيدة غير معروفة بينما تترقبها أسواق التوقعات





