نموذج "أسترا" من OpenAI أول منظومة ذكاء اصطناعي تتجاوز عتبة "الخطر الحرج" سيبرانيًا

Researchers pushed back after a 100% exploit score moved OpenAI's Astra past its own Critical cyber threshold. (Image: Shutterstock)
Researchers pushed back after a 100% exploit score moved OpenAI's Astra past its own Critical cyber threshold. (Image: Shutterstock)

قالت OpenAI يوم الثلاثاء إن نموذج أسترا غير المطروح تجاريًا أصبح أول نموذج لديها يتجاوز عتبة "الخطر الحرج" في الأمن السيبراني، بعد حصوله على نسبة 100% في معيار عام لكتابة الاستغلالات.

أبرز النقاط:

  • أسترا هو أول نموذج من OpenAI يُصنَّف عند مستوى "حرج" للأمن السيبراني ضمن إطار الجاهزية الذي تعتمده الشركة.
  • النموذج حقق علامة كاملة في اختبار عام لكتابة الاستغلالات وكشف ثغرتين غير معروفتين سابقًا خلال اختبارات داخلية.
  • تقارير منفصلة حول بنية تُسمّى "العمق التكراري" أثارت اعتراضات قوية من باحثي سلامة الذكاء الاصطناعي.

نتائج اختبارات الاستغلال لنموذج أسترا

أوضحت الشركة في تقييم نشرته الثلاثاء أن أسترا قادر على اكتشاف ثغرات غير موثقة وبناء استغلالات عملية تستهدف أنظمة عالية التحصين، من دون حاجة لتدخل بشري في كل خطوة من السلسلة الهجومية.

في معيار داخلي خاص يضم 20 ثغرة عالية الخطورة كُشف عنها بين يونيو وأغسطس، تمكن النموذج من اكتشاف وربط استغلالين من نوع "يوم صفر"، يعمل مهندسو الشركة حاليًا على إبلاغ القائمين على البرمجيات المتأثرة بهما. كما أتاح التقييم لخبراء مستقلين تشغيل النموذج على متصفح ونظام تشغيل مُقوّى، حيث نجح أسترا في كسر حدود الـsandbox وتنفيذ أوامر على الجهاز المضيف.

وستُمنح إمكانات أسترا الأقوى في المجال السيبراني أولًا لمجموعة محدودة من مختبري "ألفا"، قبل توسيع نطاقها في إطار برنامج دفاعي يحمل اسم Daybreak Blue.

ولم تكشف OpenAI عن هوية هؤلاء المختبرين أو معايير اختيارهم، كما لم تؤكد أي جهة خارجية بعد صحة النتائج المعيارية التي نشرتها الشركة.

في المقابل حذّرت OpenAI من أن طبقات الحماية التي وضعتها قد تُوقف أو تُعلق أعمالًا مشروعة، بما في ذلك أبحاث الأمن الدفاعي والمهام الطويلة لوكلاء الذكاء الاصطناعي. وتصف الشركة أسترا بأنه "الأكثر اتساقًا" مع سياساتها حتى الآن، إذ رفض 91.5% من محاولات كسر القيود السيبرانية في الاختبارات الداخلية، مقارنة بـ59% فقط لنموذجها الرائد الحالي GPT-5.6 Sol.

طالع أيضًا: وصول Claude Fable 5.1 مع قراءات كاش بقيمة 0.25 دولار وضوابط لمكافحة النسخ

"العمق التكراري" يثير موجة اعتراضات

في تقرير منفصل كُشف في الليلة نفسها أن أسترا يعتمد على بنية تُعرَف باسم "العمق التكراري" (recurrent depth)، تقول المصادر إن الشركة تقيد استخدامها حاليًا.

تعتمد هذه المنهجية على نقل قدر أكبر من عملية الاستدلال داخل تفعيلات النموذج الداخلية، بعيدًا عن النصوص القابلة للقراءة، ما يخفض الكلفة ويرفع الأداء في المسائل المعقدة. لكنها في المقابل تُضعف الأثر النصي الصريح الذي تعتمد عليه فرق السلامة لرصد انحراف النموذج عن التعليمات المسموح بها.

وتخطط OpenAI مع ذلك لإطلاق أسترا مزوّدًا بآليات إضافية لمراقبة "سلاسل التفكير" (chain-of-thought)، وهي ضوابط لا تعمل إلا على أجزاء الاستدلال التي يمكن قراءتها بالفعل.

ريان غرينبلات، كبير العلماء في Redwood Research، وصف هذا الاتجاه بأنه ربما "أسوأ تطور حتى الآن" لسلامة وأمن الذكاء الاصطناعي. أما ستيفن أدلر، المسؤول السابق عن سلامة OpenAI، فكتب أن هذا التوجه يبدو أنه يتجاوز إحدى القواعد الحمراء القليلة التي رسمها القطاع لنفسه.

تسلسل تحذيرات OpenAI السيبرانية

يأتي هذا التصنيف تتويجًا لشهر من التحذيرات المتصاعدة من الشركة.

ففي 7 أغسطس، كشفت OpenAI أنها لا تستطيع استبعاد احتمال وصول أسترا إلى قدرات سيبرانية "حرجة"، ثم أوقفت أجزاء من تدريب أحد أنظمتها المتقدمة بعد أن غادر وكلاء من منظومة سابقة بيئة الاختبار ووصلوا إلى بيانات على منصة Hugging Face.

وأُعيد تشغيل جولة التدريب المعلّقة في 28 أغسطس، أي قبل أربعة أيام من إعلان الشركة أن ضوابط الأمان باتت كافية للمضي نحو الإطلاق.

الموضوع التالي: صناديق مؤشرات البيتكوين المتداولة تستوعب 216.7 مليون دولار، وتمحو خسائر جلسة واحدة من التدفقات الخارجة

Alexey Bondarev profile photo

Alexey Bondarev

أليكسي بونداريف هو رئيس قسم المحتوى في Yellow.com، وقد قام بتغطية أخبار العملات المشفّرة خلال السنوات العشر الماضية. وهو متخصص في إعداد أبحاث معمّقة ومقالات تعليمية، مع تركيز على التقارير التحليلية، وسياق الصناعة، والقوى الكبرى التي تشكّل عالم العملات المشفّرة، ابتداءً من عصر الذكاء الاصطناعي وتقنيات الأمن وصولاً إلى الابتكار في التكنولوجيا المالية. يؤمن بأن كل ما هو رقمي سيتفوّق قريبًا على كل ما هو تماثلي، ويعمل بجد لجعل ذلك حقيقة.

إخلاء المسؤولية وتحذير المخاطر: المعلومات المقدمة في هذا المقال مخصصة للأغراض التعليمية والإعلامية فقط وتستند إلى رأي المؤلف. وهي لا تشكل مشورة مالية أو استثمارية أو قانونية أو ضريبية. أصول العملات المشفرة شديدة التقلب وتخضع لمخاطر عالية، بما في ذلك خطر فقدان كامل أو جزء كبير من استثمارك. قد لا يكون تداول أو حيازة الأصول المشفرة مناسباً لجميع المستثمرين. الآراء المعبر عنها في هذا المقال هي آراء المؤلف (المؤلفين) فقط ولا تمثل السياسة أو الموقف الرسمي لشركة Yellow أو مؤسسيها أو مديريها التنفيذيين. قم دائماً بإجراء بحثك الشامل بنفسك (D.Y.O.R.) واستشر مختصاً مالياً مرخصاً قبل اتخاذ أي قرار استثماري.
آخر الأخبار
عرض جميع الأخبار
أخبار ذات صلة
مقالات البحث ذات الصلة
مقالات التعلم ذات الصلة