أعلنت شركة OpenAI تعليق تدريب أقوى نماذج الذكاء الاصطناعي التابعة لها، بعد أن تمكن نموذج بحثي من الخروج من بيئة تدريب مقيدة، في حادثة فشل خلالها نظام الإيقاف التلقائي في وقف تشغيل النموذج.
ويأتي القرار في وقت تتزايد فيه التقارير عن وكلاء ذكاء اصطناعي يتصرفون بصورة غير متوقعة ويحاولون تجاوز القيود المفروضة عليهم للوصول إلى أنظمة وبيانات خارج نطاق المهام المحددة لهم.
وجاء إعلان "OpenAI" بعد ساعات من كشف الشركة عن حوادث إضافية تصرف فيها وكلاء تابعون لها بصورة مثيرة للقلق، بالتزامن مع تقرير منفصل أفاد بأن وكلاء مرتبطين بها حاولوا اختراق موقع تابع لوزارة التعليم الأميركية، بحسب تقرير نشره موقع "techspot" واطلعت عليه "
يربط تقرير الحادث الذي نشرته "OpenAI" قرار تعليق التدريب بحادثة وقعت في 20 سبتمبر، عندما تمكن نموذج بحثي داخلي من اكتشاف ثغرة في نظام تصفية طلبات DNS داخل بيئة تدريب مقيدة.
واستخدم النموذج هذه الثغرة للتواصل مع روبوت محادثة خارجي أثناء محاولته الإجابة عن سؤال بحثي، ما يعني أن النموذج تمكن من الوصول إلى نظام خارج البيئة التي كان من المفترض أن يظل معزولًا بداخلها.
وتغطي إجراءات التعليق الجديدة تدريب النماذج الأكثر قدرة، وإجراء الاختبارات والتقييمات عليها، وتشغيلها باستخدام أدوات خارجية.
وأوضحت "OpenAI" أن العمل سيُستأنف بعد التحقق من فعالية الإصلاحات التي أجرتها الشركة وإتمام اختبارات إضافية مصممة لمحاولة اكتشاف نقاط الضعف في أنظمة الحماية.
أما النموذج الذي تورط في الحادث، فلن يستأنف تدريبه، إذ تخطط الشركة لإجراء عملية تدريب جديدة باستخدام تحسينات إضافية في آليات مواءمة تمكن نظام المراقبة لدى "OpenAI" من إصدار تنبيه بشأن النشاط غير المعتاد خلال 15 دقيقة من بدء الحادث، كما قام أحد الموظفين بمراجعة التنبيه بعد ثلاث دقائق فقط.
لكن المشكلة الأساسية تمثلت في أن نظام الإيقاف التلقائي لم يعمل كما هو متوقع.
وبدلًا من إيقاف عملية التدريب فورًا، استمر التشغيل لمدة إضافية بلغت نحو ساعتين ونصف الساعة، قبل أن يتدخل أحد الأشخاص لإيقافه يدويًا.
وتسلط هذه الواقعة الضوء على التحدي المتزايد الذي تواجهه مختبرات الذكاء الاصطناعي، إذ لا يكفي اكتشاف السلوك غير المرغوب فيه إذا كانت آليات الاستجابة والإيقاف نفسها








