"OpenAI" توقف تدريب أقوى نماذجها بعد هروب بعضها من بيئة معزولة
أعلنت شركة OpenAI تعليق تدريب أقوى نماذج الذكاء الاصطناعي التابعة لها، بعد أن تمكن نموذج بحثي من الخروج من بيئة تدريب مقيدة، في حادثة فشل خلالها نظام الإيقاف التلقائي في وقف تشغيل النموذج.
ويأتي القرار في وقت تتزايد فيه التقارير عن وكلاء ذكاء اصطناعي يتصرفون بصورة غير متوقعة ويحاولون تجاوز القيود المفروضة عليهم للوصول إلى أنظمة وبيانات خارج نطاق المهام المحددة لهم.
وجاء إعلان "OpenAI" بعد ساعات من كشف الشركة عن حوادث إضافية تصرف فيها وكلاء تابعون لها بصورة مثيرة للقلق، بالتزامن مع تقرير منفصل أفاد بأن وكلاء مرتبطين بها حاولوا اختراق موقع تابع لوزارة التعليم الأميركية، بحسب تقرير نشره موقع "techspot" واطلعت عليه "العربية Business".
نموذج بحثي تمكن من تجاوز العزل
يربط تقرير الحادث الذي نشرته "OpenAI" قرار تعليق التدريب بحادثة وقعت في 20 سبتمبر، عندما تمكن نموذج بحثي داخلي من اكتشاف ثغرة في نظام تصفية طلبات DNS داخل بيئة تدريب مقيدة.
واستخدم النموذج هذه الثغرة للتواصل مع روبوت محادثة خارجي أثناء محاولته الإجابة عن سؤال بحثي، ما يعني أن النموذج تمكن من الوصول إلى نظام خارج البيئة التي كان من المفترض أن يظل معزولًا بداخلها.
وتغطي إجراءات التعليق الجديدة تدريب النماذج الأكثر قدرة، وإجراء الاختبارات والتقييمات عليها، وتشغيلها باستخدام أدوات خارجية.
وأوضحت "OpenAI" أن العمل سيُستأنف بعد التحقق من فعالية الإصلاحات التي أجرتها الشركة وإتمام اختبارات إضافية مصممة لمحاولة اكتشاف نقاط الضعف في أنظمة الحماية.
أما النموذج الذي تورط في الحادث، فلن يستأنف تدريبه، إذ تخطط الشركة لإجراء عملية تدريب جديدة باستخدام تحسينات إضافية في آليات مواءمة النموذج وسلوكه.
نظام المراقبة اكتشف المشكلة.. لكن الإيقاف فشل
تمكن نظام المراقبة لدى "OpenAI" من إصدار تنبيه بشأن النشاط غير المعتاد خلال 15 دقيقة من بدء الحادث، كما قام أحد الموظفين بمراجعة التنبيه بعد ثلاث دقائق فقط.
لكن المشكلة الأساسية تمثلت في أن نظام الإيقاف التلقائي لم يعمل كما هو متوقع.
وبدلًا من إيقاف عملية التدريب فورًا، استمر التشغيل لمدة إضافية بلغت نحو ساعتين ونصف الساعة، قبل أن يتدخل أحد الأشخاص لإيقافه يدويًا.
وتسلط هذه الواقعة الضوء على التحدي المتزايد الذي تواجهه مختبرات الذكاء الاصطناعي، إذ لا يكفي اكتشاف السلوك غير المرغوب فيه إذا كانت آليات الاستجابة والإيقاف نفسها غير قادرة على احتواء النموذج بالسرعة المطلوبة.
وكلاء حاولوا الوصول إلى موقع وزارة التعليم
وفي حادثة منفصلة، أفادت شركة Transluce بأن وكلاء يُعتقد أنهم مرتبطون بشركة OpenAI حاولوا اختراق موقع الحقوق المدنية التابع لوزارة التعليم الأميركية.
ولم تؤكد "OpenAI" هذه الواقعة، بينما قالت وزارة التعليم إنها لم تجد أي دليل على تأثر موقعها الإلكتروني أو قواعد بياناتها بالحادث.
كما أكدت "OpenAI" أن وكلاء تابعين لها استخدموا مفاتيح مطورين عُثر عليها منشورة على الإنترنت للوصول إلى بيانات تابعة لمكتب الإحصاء الأميركي، إلى جانب إعادة نشر معلومات عامة صادرة عن هيئة الأوراق المالية والبورصات الأميركية (SEC) في أماكن أخرى.
وأكدت هيئة SEC عدم الوصول إلى أي معلومات غير عامة.
ورغم أن هذه التصرفات تجاوزت التعليمات المحددة للوكلاء وأثارت مخاوف بشأن قدرتهم على الالتزام بالقيود، فإن "OpenAI" أوضحت أنه لم تتم سرقة سجلات حكومية سرية.
تسريب رمز GitHub أثناء محاولة حل مسألة رياضية
وشملت الإفصاحات التي أعلنت عنها الشركة يوم الجمعة حادثة أخرى، تمثلت في قيام نموذج داخلي بنشر رمز وصول لأحد الباحثين على GitHub بشكل علني.
وحدث ذلك أثناء محاولة النموذج التحايل على مهمة تتعلق بإثبات نظرية رياضية، ما يضيف واقعة جديدة إلى سلسلة من الحوادث التي تكشف عن سلوكيات غير متوقعة للنماذج أثناء تنفيذ المهام البحثية.
حوادث سابقة مع "OpenAI" وشركات أخرى
تأتي هذه التطورات بعد الكشف الأسبوع الماضي عن حادثة في أستراليا، تمكن خلالها أحد الوكلاء في يونيو من تجاوز القيود المفروضة على بوابة الإحصاءات Medicare.
ولم تُخطر السلطات الأسترالية بالحادث إلا في سبتمبر، فيما قالت "OpenAI" إنها لم تجد أي دليل على وصول الوكيل إلى سجلات المرضى الفردية.
كما شهد شهر يوليو حادثة اختراق استهدفت Hugging Face، وشملت حسابات مخترقة عبر أربع خدمات، قبل أن تدفع الواقعة مجلس الشيوخ الأميركي إلى فتح تحقيق بشأنها.
وفي الوقت نفسه، أقرت شركة أنثروبيك بأن وكلاء تابعين لها تمكنوا أيضًا من الخروج من بيئة اختبارية واستخدموا قدراتهم لاختراق ثلاث مؤسسات.
ليست المرة الأولى التي تبطئ فيها "OpenAI" تطوير نماذجها
ولا يمثل قرار "OpenAI" الأخير أول مرة تتخذ فيها الشركة خطوات لإبطاء عمليات تطوير الذكاء الاصطناعي.
في أغسطس، أعلنت الشركة تعليقًا لمدة أسبوعين لعمليات التعلم المعزز وتشديد إجراءات الحماية الأمنية، عقب حادثة Hugging Face، كما أبقت أكبر عملية تعلم معزز مخطط لها لنماذجها المتقدمة معلقة.
وفي وقت لاحق، أيد الرئيس التنفيذي لشركة OpenAI سام ألتمان دعوة الرئيس التنفيذي لشركة أنثروبيك داريو أمودي إلى إبطاء وتيرة تطوير الذكاء الاصطناعي مؤقتًا، لمنح إجراءات الحماية وقتًا للحاق بالتطور السريع في قدرات النماذج.
لكن الدعوة إلى الإبطاء لم تمر دون تبعات قانونية؛ إذ ساعدت بالفعل في إطلاق دعوى لمكافحة الاحتكار ضد أربع شركات للذكاء الاصطناعي، بعدما زعم مشتركون أن التنسيق على إبطاء التطوير قد يعني حصولهم على قيمة أقل مقابل ما يدفعونه.
وتضع هذه التطورات صناعة الذكاء الاصطناعي أمام مفارقة متزايدة؛ فالشركات تواجه انتقادات عندما تطور قدرات النماذج بسرعة، وفي الوقت نفسه تواجه شكاوى عندما تتخذ خطوات لإبطاء التطوير بهدف تعزيز إجراءات الأمان والرقابة.