أسترا من OpenAI تبدو أقل ميلاً لعرض استدلالاتها في نص واضح، في تطور يعيد إلى الواجهة مخاوف سلامة سبق توثيقها في ورقة عام 2025 عن قابلية مراقبة «سلسلة التفكير»، شارك في تأليفها كبير العلماء في الشركة ياكوب باتشوكي.
أبرز النقاط:
- «أسترا» تبدو وكأنها تنفذ جزءاً أصغر من استدلالها في نص ظاهر، ما يثير تساؤلات حول قدرة أنظمة الرقابة على التقاط السلوكيات الإشكالية.
- ريان غرينبلات وباتشوكي شاركا في تأليف ورقة بحثية صدرت في يوليو 2025 وصفت قابلية مراقبة «سلسلة التفكير» بأنها فرصة واعدة لكنها هشة في سلامة الذكاء الاصطناعي.
- الموقِّعون على «مدونة ممارسات» الاتحاد الأوروبي للذكاء الاصطناعي العام ملزمون بتقديم تقارير سلامة النماذج إلى «مكتب الذكاء الاصطناعي»، مدعومة بأدلة تقييم تتيح مراجعة مستقلة.
قابلية مراقبة «أسترا»
موقع Semafor أفاد بأن «أسترا» تنفذ حيزاً أكبر من عمليات الاستدلال «داخلية» من دون إظهارها كنص صريح، ما أثار تساؤلات حول ما إذا كان المراقبون لا يزالون قادرين على رصد السلوكيات المريبة أثناء عمل النموذج. غرينبلات، وهو باحث في سلامة الذكاء الاصطناعي لدى Redwood Research، كتب أن «أسترا يبدو قادراً على حل مسائل رياضية تنافسية معقدة بالكامل في رأسه». وأضاف: «هذا يبدو مقلقاً للغاية».
تقارير أخرى رجّحت أن OpenAI قلّصت عمداً مستوى الشفافية في مخرجات النموذج لتحسين قدراته، رغم أن الشركة لم تؤكد ذلك. باتشوكي علّق قائلاً إنه يريد «منع سباق نحو انعدام القابلية للمراقبة تغذّيه تغطية صحافية مشوَّشة».
موقع TNW كان قد أشار سابقاً إلى أن مراقبة «أسترا» أصبحت أصعب من النموذج السابق عندما حاول الأخير التحايل على آليات الإشراف، وهو مجال تصفه OpenAI بأنه أولوية بحثية مفتوحة.
اقرأ أيضاً: تقول OpenAI إن الذكاء الاصطناعي بات قادراً على إنجاز مهام بحثية تمتد لأيام
تحذير باتشوكي بشأن السلامة
حساسية الجدل الحالي تعود إلى أن غرينبلات وباتشوكي كانا ضمن نحو 40 مؤلفاً لورقة بحثية في يوليو 2025 وصفت قابلية مراقبة «سلسلة التفكير» بأنها فرصة جديدة لكنها هشة لتعزيز سلامة نماذج الذكاء الاصطناعي المتقدمة. شارك في الورقة باحثون من OpenAI وGoogle DeepMind وAnthropic وMeta وAmazon ومعهد أمن الذكاء الاصطناعي في المملكة المتحدة وRedwood Research.
الورقة دعت مطوّري نماذج الجبهة الأمامية إلى بناء اختبارات معيارية لقابلية المراقبة، ونشر نتائجها وحدودها في «بطاقات أنظمة»، والنظر إلى قابلية المراقبة باعتبارها عاملاً موازياً للقدرات عند اتخاذ قرارات التدريب أو الإطلاق.
أوروبا منحت هذه العملية قناة رسمية. فالموقّعون على «مدونة ممارسات» الاتحاد الأوروبي للذكاء الاصطناعي العام ملزمون بتقديم «تقرير نموذج» إلى مكتب الذكاء الاصطناعي عند طرح المنتج في السوق، يشمل التقييمات، وإجراءات التخفيف من المخاطر، وتقارير المقيمين الخارجيين.
كما يجب أن يتضمن كل تقرير خمسة أمثلة عشوائية من المُدخلات والمخرجات لكل تقييم ذي صلة بالنموذج، بما يزوّد المراجعين المستقلين بمادة قابلة للتدقيق، فيما تعد OpenAI موقّعاً كاملاً على المدونة.
القلق سبق إطلاق «أسترا». فقد حذّرت ورقة يوليو 2025 من أن البنى المعمارية الجديدة قد تُضعف الاستدلالات النصية في «سلسلة التفكير»، في حين قبلت OpenAI لاحقاً بزيادة في استهلاك الحوسبة تقارب 20% لصالح توسيع نطاق مراقبة السلامة في أنظمتها.
اطلع أيضاً: صناديق بتكوين المتداولة تجتذب 987 مليون دولار، وتواصل موجة التدفقات الإيجابية لثلاثة أسابيع





