يطرح رياضيون تساؤلات جدية حول مدى موثوقية 719 مخطوطة رياضية وُلدت باستخدام الذكاء الاصطناعي لدى OpenAI، بعد صدور ورقة بحثية تشير إلى أن البرهان المكتوب لمسألة نافير–ستوكس الذي روّجت له الشركة لا يتطابق مع النسخة التي جرى التحقق منها حاسوبيًا.
أبرز النقاط:
- تراجع عدد المخطوطات المنشورة من OpenAI من 722 إلى 719 بعد سحب ثلاث أوراق بسبب خطأ في إشارة رياضية.
- ثلاثة رياضيين مقيمين في المملكة المتحدة وثّقوا موضعين يتباين فيهما البرهان المكتوب لنافير–ستوكس مع شفرته في Lean.
- مؤلفو الورقة لا يصفون البرهان بأنه خاطئ، لكنهم يؤكدون أن الفحص الآلي لا يغني عن التحكيم العلمي البشري.
إصدار OpenAI الرياضي
نشرت الشركة مجموعتها البحثية في 6 أكتوبر، قبل أن يكشف تقرير صدر الخميس أن المشروع ابتعد عن الإرشادات التي وضعها فريق مستقل من الرياضيين لمعامل الذكاء الاصطناعي. الكتالوغ بدأ بـ 722 مخطوطة، لكن OpenAI سارعت إلى سحب ثلاث أوراق في اليوم التالي، بعد أن أدى خطأ في الإشارة إلى انهيار أحد الاستدلالات، ما أسقط معه ورقتين استندتا إليه.
الإرشادات، التي صدرت في 29 سبتمبر عن مجموعة الاستشارات في الرياضيات والذكاء الاصطناعي المكوّنة من تسعة أعضاء، افتتحت بدعوة المختبرات إلى التوقف عن اختبار مسائل رياضية متقدمة على نماذج ملكية مغلقة. مستودع OpenAI يوضح أن الأوراق جاءت من تقييم نموذج داخلي غير معلن على مسائل بحثية مفتوحة.
شروح مسار تفكير النموذج لا ترافق سوى 10 نتائج فقط، في حين جرى «ترسيم» نحو 42% من النتائج الرئيسة في لغة Lean، وهي لغة برمجة تتيح التحقق الآلي من صحة البراهين.
اقرأ أيضًا: كم يتقاضى الرئيس التنفيذي لـ Anthropic؟ ملف الطرح للاكتتاب يكشف التفاصيل
ثغرات في برهان نافير–ستوكس
كل من ألكسندر باستونيس من كلية كينغز في لندن، وفابيان تشيرتشيللي وأندرس هانسن من جامعة كامبريدج، قاموا بفحص برهان نافير–ستوكس الذي أعلنت عنه OpenAI في سبتمبر. الباحثون رصدوا موضعين يتباعد فيهما البرهان المكتوب عن شفرته في Lean، بينها حالة يثبت فيها الكود تقديرًا أضعف من التقدير المعلن في الورقة.
المؤلفون يشددون على أنهم لا يصدرون حكمًا قاطعًا حول صحة البرهان المكتوب من عدمها. هدفهم أضيق: Lean يؤكد أن النتيجة النهائية صحيحة، على حد تعبيرهم، لكنه لا يضمن أن الخطوات الوسيطة التي يقرأها الإنسان خالية من العيوب، ما يعني أن هذه البراهين لا تزال بحاجة إلى تحكيم بشري كامل.
حامل وسام فيلدز تيرينس تاو كتب في 6 أكتوبر أن بعض المسائل يجري حلها بواسطة «مُلقّني ذكاء اصطناعي» لا يمتلكون فهمًا كافيًا للإجابات التي ينتجها النموذج بما يسمح لهم بتقديمها أو الدفاع عنها. من جانبها، قالت أستاذة هارفارد ميلاني ماتشِت وود، وهي عضوة في المجموعة الاستشارية، إنه عندما تُنشر مثل هذه النتائج «لا يكون هناك أي إنسان يفهمها كاملة، ومن هنا يبدأ العمل الحقيقي».
نزاع حول برهان OpenAI
المجموعة الاستشارية شددت على أن المجتمع الرياضي الأوسع وحده قادر على الحكم على مدى التزام OpenAI بتوصياتها. ويأتي هذا التدقيق بعد شهر متوتر؛ إذ أعلنت OpenAI عن نتيجة نافير–ستوكس في 8 سبتمبر، الأمر الذي فجّر نزاعًا حول الأسبقية مع عالم الرياضيات في جامعة نيويورك تريستان باكماستر. وبعد ثلاثة أيام فقط، أطلق 25 من حاملي وسام فيلدز بيانًا حذروا فيه من أن الإنتاج واسع النطاق لنتائج رياضية بواسطة الذكاء الاصطناعي قد يلحق ضررًا بالمجال.
للمتابعة: أوراق OpenAI الـ722 في الرياضيات أصبحت علنية، والآن على الرياضيين تقييمها

