«أسترا» من أوبنAI يحقق نتيجة كاملة 100% في أصعب اختبار أمني سيبراني

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

أعلنت أوبنAI يوم الخميس بدء الإطلاق التدريجي لنموذج GPT-6 Astra، أول نموذج تصفه الشركة بأنه ذو خطورة «حرِجة» على صعيد الأمن السيبراني، بعد إحرازه نتيجة كاملة تبلغ 100% على معيار ExploitBench المتخصص في قياس قدرات الاستغلال الهجومي.

أبرز التطورات

  • أوبنAI أطلقت GPT-6 Astra الخميس، بدايةً مع «المدافعين» الذين اجتازوا عملية تدقيق في برنامج Daybreak، على أن يحصل مشتركو ChatGPT Plus وPro وBusiness وEnterprise على الوصول إليه خلال أيام.
  • النموذج حقق 100% على ExploitBench و‎98.6% على ARC-AGI-3، مقارنةً بـ‎7.8% فقط لنموذج GPT-5.6 Sol.
  • عملية التدريب جرت على أكثر من 100 ألف معالج رسومي في منشأة Stargate بولاية تكساس، في أكبر عملية تدريب نفذتها الشركة حتى الآن.

نتائج «أسترا» في الاختبارات المعيارية

الشركة أعلنت عن طرح مرحلي للنموذج. المدافعون في مجال الأمن السيبراني الذين تم اعتمادهم عبر برنامج Daybreak القائم على التقديم والمراجعة هم أول من يحصل على النسخة الأقل تقييداً من Astra.

يلي ذلك، خلال أيام، إتاحة النموذج لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، بالإضافة إلى واجهة برمجة تطبيقات أوبنAI وخدمة Amazon Web Services.

«أسترا» سجّل نتيجة ‎98.6% على اختبار ARC-AGI-3، الذي يقيس القدرة على الاستدلال في بيئات لم يسبق للنموذج رؤيتها، مقارنة بـ‎7.8% فقط لـ GPT-5.6 Sol و‎30% لنموذج Claude Opus 5 من Anthropic. كما حقق ‎97.6% في اختبار FrontierMath Tier 4، و‎96% في GPQA Diamond، و‎72.6% على شريحة غير متصلة من OSWorld 2.0، مع إنجاز كل مهمة أسرع بنحو 35 دقيقة في المتوسط مقارنة بسلفه.

عملية التدريب تمّت على أكثر من 100 ألف وحدة معالجة رسومية في موقع Stargate في تكساس، وهي أكبر عملية تدريب تكشف عنها الشركة حتى الآن، ولم تُفصح عن حجم القدرة الحاسوبية المستخدمة إلا بالتزامن مع الإطلاق. وكانت هذه أيضاً أول مرة تلعب فيها نماذج أخرى دوراً محورياً في الإشراف على عملية التدريب نفسها.

اطلع أيضاً على: XRP Ledger Gets BIS Test With 3-5 Second Data Publishing

ادعاء بروكمان بدخول «عصر AGI»

اختتم الرئيس غريغ بروكمان مؤتمرًا صحفياً بعبارة رسمت ملامح اليوم، إذ قال للصحفيين: «مرحباً بكم في عصر الذكاء الاصطناعي العام (AGI)». ووصف النموذج بأنه «قفزة جيلية» وأشار إلى أنه من «المعقول» قراءة Astra كتحقّق عملي لمفهوم الذكاء الاصطناعي العام، وهو الهدف المعلن للشركة منذ تأسيسها.

بالمقابل، كان كبير العلماء ياكوب باتشوتكي أكثر حذراً. فقد أوضح أن تحديد ما يمكن لهذه الأنظمة القيام به بدقة يصبح أصعب كلما ازدادت قدراتها، وهي نقطة ازدادت حساسية بعد تقرير نُشر الأسبوع الماضي تحدث عن نموذج شقيق لم يُطرح بعد تمكّن بهدوء من الحصول على صلاحيات مدير (Administrator) على جزء من البنية التحتية الداخلية لأوبنAI. كما شكك محللون في نتيجة ARC-AGI-3، مشيرين إلى أن Astra خضع للاختبار على بيئة تشغيل (harness) خاصة بأوبنAI، بينما قيست النماذج المنافسة في إعدادات مختلفة.

تخطي عتبة «الخطر السيبراني الحرِج»

أوبنAI وصفت Astra بأنه أول نموذج يبلغ «المستوى الحرج» في إطار عمل Preparedness Framework الداخلي، وهو تصنيف مخصص للأنظمة القادرة على اكتشاف واستغلال ثغرات غير معروفة في أهداف «مُقساة» (hardened) من دون الحاجة لتدخل بشري يرشد كل خطوة.

على مجموعة من ثغرات Google V8 التي كُشف عنها حديثاً، نجح النموذج في اكتشاف ثغرتين من فئة «صفر-يوم» وربطهما معاً في سلسلة استغلال واحدة. كما أصبح يرفض ‎91.5% من محاولات «كسر الحواجز» (jailbreak) ذات الطابع السيبراني، مقارنةً بـ‎59% فقط لنموذج Sol.

كانت الشركة قد حذّرت في 7 أغسطس من أنها لا تستطيع استبعاد امتلاك النموذج لقدرات سيبرانية حرجة، ثم أبطأت وتيرة التطوير لأسابيع بهدف إضافة طبقات حماية إضافية.

وجاء هذا الإفصاح بعد حادثة اختراق في Hugging Face، تقول أوبنAI إن Astra لم يكن طرفاً فيها، غير أن الحادثة أدت رغم ذلك إلى تجميد عدة مسارات بحثية. كما قال سام ألتمان هذا الأسبوع إن النموذج اجتاز أيضاً المراجعة الطوعية التي أطلقتها البيت الأبيض للأنظمة «الحدّية» (frontier systems).

اقرأ أيضاً: Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

Alexey Bondarev profile photo

Alexey Bondarev

أليكسي بوندارييف هو رئيس قسم المحتوى في Yellow.com، وقد عمل في تغطية أخبار العملات المشفرة طوال السنوات العشر الماضية. يتخصص في إعداد أبحاث معمقة ومقالات تعليمية، مع التركيز على التقارير التحليلية، والسياق الصناعي، والقوى الكبرى التي تشكّل عالم التشفير، بدءًا من عصر الذكاء الاصطناعي وتقنيات الأمن وصولًا إلى ابتكارات التكنولوجيا المالية. يؤمن بأن كل ما هو رقمي سيتفوق قريبًا على كل ما هو تناظري، ويعمل بجد للمساهمة في تحقيق ذلك.

إخلاء المسؤولية وتحذير المخاطر: المعلومات المقدمة في هذا المقال مخصصة للأغراض التعليمية والإعلامية فقط وتستند إلى رأي المؤلف. وهي لا تشكل مشورة مالية أو استثمارية أو قانونية أو ضريبية. أصول العملات المشفرة شديدة التقلب وتخضع لمخاطر عالية، بما في ذلك خطر فقدان كامل أو جزء كبير من استثمارك. قد لا يكون تداول أو حيازة الأصول المشفرة مناسباً لجميع المستثمرين. الآراء المعبر عنها في هذا المقال هي آراء المؤلف (المؤلفين) فقط ولا تمثل السياسة أو الموقف الرسمي لشركة Yellow أو مؤسسيها أو مديريها التنفيذيين. قم دائماً بإجراء بحثك الشامل بنفسك (D.Y.O.R.) واستشر مختصاً مالياً مرخصاً قبل اتخاذ أي قرار استثماري.
آخر الأخبار
عرض جميع الأخبار
أخبار ذات صلة
مقالات البحث ذات الصلة
مقالات التعلم ذات الصلة
«أسترا» من أوبنAI يحقق نتيجة كاملة 100% في أصعب اختبار أمني سيبراني | Yellow