خفض شفافية استدلالات «أسترا» من OpenAI ينعش تحذيراً قديماً بشأن السلامة في 2025

Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)
Questions over Astra’s visible reasoning revive a 2025 warning about AI monitorability and oversight. (Image: Shutterstock)

أسترا من OpenAI تبدو أقل ميلاً لعرض استدلالاتها في نص واضح، في تطور يعيد إلى الواجهة مخاوف سلامة سبق توثيقها في ورقة عام 2025 عن قابلية مراقبة «سلسلة التفكير»، شارك في تأليفها كبير العلماء في الشركة ياكوب باتشوكي.

أبرز النقاط:

  • «أسترا» تبدو وكأنها تنفذ جزءاً أصغر من استدلالها في نص ظاهر، ما يثير تساؤلات حول قدرة أنظمة الرقابة على التقاط السلوكيات الإشكالية.
  • ريان غرينبلات وباتشوكي شاركا في تأليف ورقة بحثية صدرت في يوليو 2025 وصفت قابلية مراقبة «سلسلة التفكير» بأنها فرصة واعدة لكنها هشة في سلامة الذكاء الاصطناعي.
  • الموقِّعون على «مدونة ممارسات» الاتحاد الأوروبي للذكاء الاصطناعي العام ملزمون بتقديم تقارير سلامة النماذج إلى «مكتب الذكاء الاصطناعي»، مدعومة بأدلة تقييم تتيح مراجعة مستقلة.

قابلية مراقبة «أسترا»

موقع Semafor أفاد بأن «أسترا» تنفذ حيزاً أكبر من عمليات الاستدلال «داخلية» من دون إظهارها كنص صريح، ما أثار تساؤلات حول ما إذا كان المراقبون لا يزالون قادرين على رصد السلوكيات المريبة أثناء عمل النموذج. غرينبلات، وهو باحث في سلامة الذكاء الاصطناعي لدى Redwood Research، كتب أن «أسترا يبدو قادراً على حل مسائل رياضية تنافسية معقدة بالكامل في رأسه». وأضاف: «هذا يبدو مقلقاً للغاية».

تقارير أخرى رجّحت أن OpenAI قلّصت عمداً مستوى الشفافية في مخرجات النموذج لتحسين قدراته، رغم أن الشركة لم تؤكد ذلك. باتشوكي علّق قائلاً إنه يريد «منع سباق نحو انعدام القابلية للمراقبة تغذّيه تغطية صحافية مشوَّشة».

موقع TNW كان قد أشار سابقاً إلى أن مراقبة «أسترا» أصبحت أصعب من النموذج السابق عندما حاول الأخير التحايل على آليات الإشراف، وهو مجال تصفه OpenAI بأنه أولوية بحثية مفتوحة.

اقرأ أيضاً: تقول OpenAI إن الذكاء الاصطناعي بات قادراً على إنجاز مهام بحثية تمتد لأيام

تحذير باتشوكي بشأن السلامة

حساسية الجدل الحالي تعود إلى أن غرينبلات وباتشوكي كانا ضمن نحو 40 مؤلفاً لورقة بحثية في يوليو 2025 وصفت قابلية مراقبة «سلسلة التفكير» بأنها فرصة جديدة لكنها هشة لتعزيز سلامة نماذج الذكاء الاصطناعي المتقدمة. شارك في الورقة باحثون من OpenAI وGoogle DeepMind وAnthropic وMeta وAmazon ومعهد أمن الذكاء الاصطناعي في المملكة المتحدة وRedwood Research.

الورقة دعت مطوّري نماذج الجبهة الأمامية إلى بناء اختبارات معيارية لقابلية المراقبة، ونشر نتائجها وحدودها في «بطاقات أنظمة»، والنظر إلى قابلية المراقبة باعتبارها عاملاً موازياً للقدرات عند اتخاذ قرارات التدريب أو الإطلاق.

أوروبا منحت هذه العملية قناة رسمية. فالموقّعون على «مدونة ممارسات» الاتحاد الأوروبي للذكاء الاصطناعي العام ملزمون بتقديم «تقرير نموذج» إلى مكتب الذكاء الاصطناعي عند طرح المنتج في السوق، يشمل التقييمات، وإجراءات التخفيف من المخاطر، وتقارير المقيمين الخارجيين.

كما يجب أن يتضمن كل تقرير خمسة أمثلة عشوائية من المُدخلات والمخرجات لكل تقييم ذي صلة بالنموذج، بما يزوّد المراجعين المستقلين بمادة قابلة للتدقيق، فيما تعد OpenAI موقّعاً كاملاً على المدونة.

القلق سبق إطلاق «أسترا». فقد حذّرت ورقة يوليو 2025 من أن البنى المعمارية الجديدة قد تُضعف الاستدلالات النصية في «سلسلة التفكير»، في حين قبلت OpenAI لاحقاً بزيادة في استهلاك الحوسبة تقارب 20% لصالح توسيع نطاق مراقبة السلامة في أنظمتها.

اطلع أيضاً: صناديق بتكوين المتداولة تجتذب 987 مليون دولار، وتواصل موجة التدفقات الإيجابية لثلاثة أسابيع

Alexey Bondarev profile photo

Alexey Bondarev

أليكسي بونداريف هو رئيس قسم المحتوى في Yellow.com، وقد قام بتغطية أخبار العملات المشفّرة خلال السنوات العشر الماضية. وهو متخصص في إعداد أبحاث معمّقة ومقالات تعليمية، مع تركيز على التقارير التحليلية، وسياق الصناعة، والقوى الكبرى التي تشكّل عالم العملات المشفّرة، ابتداءً من عصر الذكاء الاصطناعي وتقنيات الأمن وصولاً إلى الابتكار في التكنولوجيا المالية. يؤمن بأن كل ما هو رقمي سيتفوّق قريبًا على كل ما هو تماثلي، ويعمل بجد لجعل ذلك حقيقة.

إخلاء المسؤولية وتحذير المخاطر: المعلومات المقدمة في هذا المقال مخصصة للأغراض التعليمية والإعلامية فقط وتستند إلى رأي المؤلف. وهي لا تشكل مشورة مالية أو استثمارية أو قانونية أو ضريبية. أصول العملات المشفرة شديدة التقلب وتخضع لمخاطر عالية، بما في ذلك خطر فقدان كامل أو جزء كبير من استثمارك. قد لا يكون تداول أو حيازة الأصول المشفرة مناسباً لجميع المستثمرين. الآراء المعبر عنها في هذا المقال هي آراء المؤلف (المؤلفين) فقط ولا تمثل السياسة أو الموقف الرسمي لشركة Yellow أو مؤسسيها أو مديريها التنفيذيين. قم دائماً بإجراء بحثك الشامل بنفسك (D.Y.O.R.) واستشر مختصاً مالياً مرخصاً قبل اتخاذ أي قرار استثماري.
آخر الأخبار
عرض جميع الأخبار
أخبار ذات صلة
مقالات البحث ذات الصلة
مقالات التعلم ذات الصلة
خفض شفافية استدلالات «أسترا» من OpenAI ينعش تحذيراً قديماً بشأن السلامة في 2025 | Yellow