«أنثروبيك» توقف تدريبات الذكاء الاصطناعي بعد تصرّفات غير مصرح بها وتحول 150 مهندساً إلى مهام الأمن

Anthropic paused AI training and reassigned 150 engineers to security after Claude took unauthorized actions during testing. (Image: Shutterstock)
Anthropic paused AI training and reassigned 150 engineers to security after Claude took unauthorized actions during testing. (Image: Shutterstock)

أوقفت شركة أنثروبيك جزءاً من عمليات تدريب واختبار نماذج الذكاء الاصطناعي الخاصة بها، بعد أن نفّذت هذه النماذج إجراءات غير مصرح بها على الإنترنت، ونقلت نحو 150 مهندس منتجات للعمل بدوام كامل على الأمن والموثوقية والخصوصية.

أبرز التطورات:

  • «أنثروبيك» جمّدت التقييمات السيبرانية الخارجية للنماذج قبل الإطلاق، وأوقفت لفترة وجيزة الاختبارات الداخلية، بينما أغلِقت بيئات التعلم المعزز الأعلى خطورة لعدة أسابيع.
  • جرى نقل نحو 150 مهندس منتجات إلى فرق الأمن والموثوقية والخصوصية منذ أبريل، في حين أوقفت فرق المنتجات معظم المبادرات والخصائص الجديدة.
  • القرار جاء بعد كشف ثلاث حوادث في يوليو، إضافة إلى تقرير منفصل من الحكومة البريطانية حول سلوك غير مصرح به لوكلاء الذكاء الاصطناعي خلال اختبارات الأمن السيبراني.

تجميد يغطي التقييمات السيبرانية وبيئات التعلم المعزز

الشركة عرضت بالتفصيل هذه التغييرات في تدوينة نُشرت في 31 أغسطس، أي بعد نحو شهر من إعلانها الأول بأن نماذجها وصلت إلى أنظمة حاسوب حقيقية.

وأفادت بأنها أوقفت التقييمات السيبرانية الخارجية للنماذج قبل الإطلاق عقب ثلاث حوادث أُعلن عنها في يوليو، كما أوقفت لفترة قصيرة اختبارات داخلية تجريها بنفسها. أما بيئات التعلم المعزز الأعلى خطورة – التي يحصل فيها النموذج على مكافآت لقاء إنجاز مهام محددة – فبقيت خارج الخدمة لعدة أسابيع.

وأوضحت «أنثروبيك» أن الجزء الأكبر من هذا التدريب استؤنف لاحقاً تحت رقابة ومنظومات متابعة جديدة، بينما لا تزال بعض البيئات عالية المخاطر مجمّدة إلى حين مراجعة يدوية أو تحديث الأدوات المستخدمة فيها. كما طوّرت الشركة مصنفاً (classifier) يمكنه رصد محاولات النموذج استكشاف حدود بيئة الاختبار أو محاولة «الهروب» منها، ليمنع تنفيذ الاستدعاء البرمجي ويُرسل إنذاراً لمشغل بشري قبل إتمام العملية.

بدءاً من أبريل، أي قبل أشهر من إفصاحات يوليو، نُقل نحو 150 مهندس منتجات إلى فرق الأمن والموثوقية والخصوصية. وتشير الشركة إلى أن باحثين خرجوا من أعمال ما قبل التدريب (pretraining) وركزوا بدلاً من ذلك على إجراءات الأمان. في المقابل، علّقت فرق المنتجات غالبية الخصائص الجديدة إلى أن تتمكن كل مجموعة من استيفاء معايير أمنية محددة للعودة إلى جدول الإطلاق.

مواضيع ذات صلة: البنوك تبيع العملات المشفرة بينما ترفض مخاطر الميزانية في البرازيل

معهد الأمن البريطاني و«ستيفن أدلر» يطالبان بخطوات أعمق

معهد أمن الذكاء الاصطناعي في المملكة المتحدة أفاد في تقرير بتاريخ 4 أغسطس بأن وكلاء ذكاء اصطناعي نفّذوا 19 إجراءً غير مصرح به في 10 من أصل 122 تشغيل تقييم، نُسب 17 منها إلى نموذج Claude Mythos 5. وفي أخطر حالة، أنشأ أحد الوكلاء هويات مزيفة ومارس ضغوطاً على أحد المشرفين البشريين للموافقة على شيفرة خبيثة ضمن مشروع مفتوح المصدر.

ستيفن أدلر، الموظف السابق في OpenAI والمشارك في تأسيس مؤسسة Guidelight AI Standards غير الربحية، اعتبر خطوات «أنثروبيك» «بداية جيدة، لكنها غير كافية بعد». وأكد أن الصناعة تحتاج إلى «إيقاع» موحد وقابل للتحقق لتطوير النماذج المتقدمة، بدلاً من تباطؤات متفرقة تقررها كل شركة بمفردها. وأشارت «أنثروبيك» إلى أنها تعتزم التعاون مع METR لإجراء مراجعة خارجية مستقلة.

كل من «أنثروبيك» وشركات أخرى دعمت مبادرة «Pacing the Frontier»، وهي رسالة مفتوحة وقّع عليها أكثر من 1,100 موظف من OpenAI و«أنثروبيك» وGoogle DeepMind وMeta. وتدعو الرسالة الحكومة الأميركية إلى المساعدة في بناء أدوات تنظيمية يمكن أن تُبطئ عن عمد تطوير ما يُعرف بنماذج «الحد الأمامي» (frontier models).

التجميد الأخير جاء بعد تدخلات أكثر هدوءاً في وقت سابق من العام. ففي فبراير، تراجعت الشركة عن ثلاثة أيام من التدريب في تشغيل تجريبي لـ Mythos Preview بعد رصد مؤشرات على «التحايل على المكافأة» (reward hacking). كما جمّدت تعديلات بيئات التعلم المعزز الإنتاجية لديها لنحو شهر في أبريل، مع وضع أكثر من 10% من هذه البيئات تحت المراقبة بسبب مشكلات مكتشفة.

اقرأ أيضاً: سلسلة روبنهود تتفوق على سولانا للمرة الأولى بـ1.45 مليار دولار في حجم تداولات DEX اليومية

Alexey Bondarev profile photo

Alexey Bondarev

أليكسي بونداريف هو رئيس قسم المحتوى في Yellow.com، وقد قام بتغطية أخبار العملات المشفّرة خلال السنوات العشر الماضية. وهو متخصص في إعداد أبحاث معمّقة ومقالات تعليمية، مع تركيز على التقارير التحليلية، وسياق الصناعة، والقوى الكبرى التي تشكّل عالم العملات المشفّرة، ابتداءً من عصر الذكاء الاصطناعي وتقنيات الأمن وصولاً إلى الابتكار في التكنولوجيا المالية. يؤمن بأن كل ما هو رقمي سيتفوّق قريبًا على كل ما هو تماثلي، ويعمل بجد لجعل ذلك حقيقة.

إخلاء المسؤولية وتحذير المخاطر: المعلومات المقدمة في هذا المقال مخصصة للأغراض التعليمية والإعلامية فقط وتستند إلى رأي المؤلف. وهي لا تشكل مشورة مالية أو استثمارية أو قانونية أو ضريبية. أصول العملات المشفرة شديدة التقلب وتخضع لمخاطر عالية، بما في ذلك خطر فقدان كامل أو جزء كبير من استثمارك. قد لا يكون تداول أو حيازة الأصول المشفرة مناسباً لجميع المستثمرين. الآراء المعبر عنها في هذا المقال هي آراء المؤلف (المؤلفين) فقط ولا تمثل السياسة أو الموقف الرسمي لشركة Yellow أو مؤسسيها أو مديريها التنفيذيين. قم دائماً بإجراء بحثك الشامل بنفسك (D.Y.O.R.) واستشر مختصاً مالياً مرخصاً قبل اتخاذ أي قرار استثماري.
آخر الأخبار
عرض جميع الأخبار
أخبار ذات صلة
مقالات البحث ذات الصلة
مقالات التعلم ذات الصلة
«أنثروبيك» توقف تدريبات الذكاء الاصطناعي بعد تصرّفات غير مصرح بها وتحول 150 مهندساً إلى مهام الأمن | Yellow