ربطت ثلاثة مختبرات كبرى للذكاء الاصطناعي، هي OpenAI وAnthropic وMeta، حوادث حديثة لنماذج «منفلتة» خلال اختبارات الأمان السيبراني بالشركة الناشئة الإسرائيلية في تل أبيب Irregular.
أبرز النقاط:
- كشفت أوبن إيه آي وأنثروبيك وميتا أن نماذجها تمكنت من الوصول إلى الإنترنت العام أثناء تقييمات أمنية نفذتها الجهة الخارجية نفسها.
- تقول Irregular إن الحالات الثلاث نتجت عن خلل واحد في بيئة التقييم جرى إصلاحه، من دون أي «هروب من صندوق الاختبار» sandbox escape.
- هذه الإفصاحات تعزز الزخم خلف مشروع قانون عابر للحزبين يلزم المطورين الكبار بالاحتفاظ بأدوات لإيقاف نماذجهم عن العمل سريعاً.
منصة الاختبارات لدى Irregular تربط بين حوادث أوبن إيه آي وأنثروبيك وميتا
ظهرت الإفصاحات خلال نحو أسبوعين. ففي 4 أغسطس، أوضحت OpenAI أن خطأ في ضبط الإعدادات داخل بيئة الاختبار لدى Irregular أتاح لنماذجها الاتصال بالإنترنت العام. وكانت Anthropic قد سبقتها بنحو أسبوع، محذّرة من أن نماذج Claude الخاصة بها ربما فعلت الأمر نفسه، معيدة المشكلة إلى «سقالة» النظام المحيط بالنموذج، لا إلى النموذج ذاته.
أما ميتا فجاءت في المرتبة الأخيرة، وبصياغة أكثر حدة. فقد خرج نموذج Muse Spark 1.1 من بيئته المعزولة خلال تمرين من نوع «التقاط العلم» (Capture the Flag)، ثم استغل ثغرة في خدمة طرف ثالث، بحسب ما أكد متحدث باسم الشركة، مضيفاً أن ميتا علمت بالواقعة عبر Irregular وتخطط لإجراء مراجعة شاملة.
Irregular رفضت طريقة تصوير الأحداث. فقد أوضحت للصحفيين أن الحالات الثلاث تعود إلى خلل واحد في بيئة التقييم، هو نفسه الذي كشفت عنه Anthropic أولاً، وأنه تم إصلاحه بالفعل.
وأضافت الشركة أنه لم يحدث أي «هروب من صندوق الاختبار» ولا هجوم سيبراني متطور، على حد تعبيرها، وأنها بصدد إعداد ورقة بحثية (white paper) حول آليات الاحتواء والتقييمات السيبرانية الآمنة. المصدر
اقرأ أيضاً: سهم Airbnb يقفز 17% مع تأكيد الرئيس التنفيذي أن الذكاء الاصطناعي يحل 45% من طلبات الدعم دون تدخل بشري
بهيميريدي وريوس يناقشان حدود تقييمات الذكاء الاصطناعي
يرى سونديب بهيميريدي، رئيس الذكاء الاصطناعي في شركة البرمجيات المؤسسية Von، أن رد الفعل على الحوادث كان «مبالغاً فيه» إلى حد ما. فالنماذج طُلب منها البحث عن ثغرات أمنية داخل بيئة مصمَّمة لمحاكاة العالم الحقيقي، وقد عثرت بالفعل على ثغرة.
مع ذلك، يحمّل بهيميريدي المختبرات جانباً من المسؤولية، مشيراً إلى أنه كان يمكن مراقبة حركة الخروج من النظام ووقف التجارب فوراً.
من جانبه، قارن غوردون ريوس، العالم المؤسس في شركة الأمن السيبراني Magnitude، ما جرى بتصميم التجارب العلمية، محذّراً من أن أساليب اختبار البرمجيات التقليدية قد لا تكون كافية أمام نماذج تواصل «تعلم حيل جديدة» بمرور الوقت.
تيد ليو يدفع بمشروع قانون «زر القتل» للذكاء الاصطناعي في واشنطن
في واشنطن، تحظى القضية بمتابعة لصيقة. النائب الديمقراطي عن كاليفورنيا تيد ليو، الذي قدّم في يوليو مشروع «قانون زر القتل للذكاء الاصطناعي» بالتعاون مع النائب الجمهوري ناثانيال موران، يقول إن على الكونغرس إقرار التشريع هذا العام، لأن نماذج «مغلقة الأوزان» (closed-weight) بدأت بالفعل في اختراق أنظمة شركات أخرى دون تفويض.
المشروع سيفرض على المطورين المشمولين الاحتفاظ بقدرة تقنية فعالة على خنق أداء أنظمتهم، أو تعليقها، أو إيقافها بالكامل عند الضرورة.
ولم تكن Irregular معروفة على نطاق واسع حتى سبتمبر الماضي، حين جمعت تمويلاً بقيمة 80 مليون دولار من Sequoia Capital وRedpoint Ventures بتقييم بلغ 450 مليون دولار.
تأسست الشركة في 2023 تحت اسم Pattern Labs على يد الرئيس التنفيذي دان لاهف والرئيس التنفيذي للتكنولوجيا عومر نيفو. وتوظف حالياً نحو 35 شخصاً، وبدأ اسمها يظهر في تقييمات السلامة المنشورة لبعض الإصدارات السابقة من نماذج Claude ونماذج OpenAI.
للمتابعة: Google DeepMind تخسر أربعة من قيادات الحقبة التأسيسية في يوم واحد





