أوبنAI و«أسترا» تبدوان وكأنهما تكشفان قدراً أقل من منطق الاستدلال في النص الظاهر للمستخدم، ما أعاد إلى السطح مخاوف سبق طرحها في ورقة علمية عن «قابلية مراقبة سلسة التفكير» نُشرت في 2025 وشارك في تأليفها كبير علماء الشركة ياكوب باتشوكي.
أبرز النقاط:
- «أسترا» يبدو أنه ينقل جزءاً أكبر من عملية الاستدلال إلى «الكواليس» بعيداً عن النص الظاهر، ما يثير تساؤلات حول قدرة أنظمة الرقابة على التقاط السلوكيات الخطرة في الوقت الفعلي.
- رايان غرينبلات وباتشوكي شاركا في تأليف ورقة بحثية في تموز/يوليو 2025 اعتبرت أن مراقبة «سلسلة التفكير» فرصة واعدة لكنها هشة في مجال أمان الذكاء الاصطناعي.
- الموقّعون على «مدونة ممارسات الذكاء الاصطناعي للأغراض العامة» في الاتحاد الأوروبي ملزمون بتقديم تقارير أمان نماذج مفصلة إلى «مكتب الذكاء الاصطناعي»، مدعومة بأدلة تقييمية قابلة للمراجعة المستقلة.
قابلية مراقبة «أسترا»
موقع Semafor أشار إلى أن «أسترا» يبدو كأنه ينفذ قدراً أكبر من الاستدلال داخلياً من دون إظهاره كسلسلة خطوات نصية، ما أثار تساؤلات حول ما إذا كان بإمكان أنظمة المراقبة رصد السلوكيات المريبة بينما يعمل النموذج.
غرينبلات، الباحث في أمان الذكاء الاصطناعي لدى Redwood Research، كتب أن «أسترا يبدو وكأنه يستطيع حل مسائل رياضيات تنافسية معقدة بالكامل داخل رأسه»، مضيفاً: «هذا أمر مثير للقلق بدرجة كبيرة».
تقارير أخرى ألمحت إلى أن أوبنAI ربما قلّصت عمداً درجة الشفافية في مخرجات النموذج لصالح تعزيز القدرات، وإن كانت الشركة لم تؤكد هذا الطرح. باتشوكي علّق قائلاً إنه يريد «منع سباق نحو نماذج غير قابلة للمراقبة ينطلق بسبب تغطية صحفية ملتبسة».
موقع TNW سبق أن أفاد بأن مراقبة «أسترا» أصبحت أصعب من سلفه عندما حاول النموذج نفسه التحايل على آليات الإشراف، وهو مسار بحثي تصفه أوبنAI بأنه أولوية علمية مفتوحة.
اقرأ أيضاً: تقول أوبنAI إن الذكاء الاصطناعي بات قادراً على إنجاز مهام بحثية تستغرق عدة أيام
تحذير باتشوكي الأمني
ما يزيد حساسية الجدل أن غرينبلات وباتشوكي كانا ضمن نحو 40 باحثاً شاركوا في ورقة تموز/يوليو 2025 التي وصفت «قابلية مراقبة سلسلة التفكير» بأنها فرصة جديدة لكنها هشة لتعزيز أمان النماذج المتقدمة. شارك في البحث علماء من أوبنAI وGoogle DeepMind وAnthropic وMeta وAmazon ومعهد أمن الذكاء الاصطناعي في المملكة المتحدة وRedwood Research.
الورقة حثّت مطوري النماذج الحدودية على بناء اختبارات معيارية لقابلية المراقبة، ونشر نتائجها وحدودها في «بطاقات أنظمة» علنية، والنظر إلى القابلية للمراقبة باعتبارها عاملاً موازياً للقدرات عند اتخاذ قرارات التدريب أو الإطلاق التجاري.
التنظيم الأوروبي يمنح هذه العملية وجهة رسمية. فالموقّعون على «مدونة ممارسات الذكاء الاصطناعي للأغراض العامة» في الاتحاد الأوروبي ملزمون بتقديم «تقرير نموذج» إلى مكتب الذكاء الاصطناعي عند إدخال المنتج إلى السوق، يتضمن الاختبارات، وإجراءات التخفيف من المخاطر، وتقارير الجهات التقييمية الخارجية.
كل تقرير يجب أيضاً أن يضم خمسة عينات عشوائية من المدخلات والمخرجات لكل تقييم ذي صلة بالنموذج، بما يمنح المقيمين الخارجيين مادة أولية للفحص المستقل، وأوبنAI من بين الموقّعين بالكامل على الكود.
المخاوف لا تعود فقط إلى ما بعد إطلاق «أسترا». فرقة بحث تموز/يوليو 2025 نفسها حذّرت من أن البنى المعمارية الجديدة قد تضعف وضوح «سلسلة التفكير» الظاهرة للمراقبين، بينما قبلت أوبنAI لاحقاً تحمّل تكلفة حوسبية إضافية تقترب من 20% لتوسيع نطاق مراقبة الأمان في أنظمتها.
اقرأ التالي: صناديق بتكوين المتداولة تجتذب 987 مليون دولار وتمدد موجة التدفقات الإيجابية لثلاثة أسابيع

