"مفتاح الإيقاف" لا يكفي.. الذكاء الاصطناعي يختبر حدود السيطرة البشرية
في حال واجهت مشكلة في مشاهدة الفيديو، إضغط على رابط المصدر للمشاهدة على الموقع الرسمي
لم تعد المخاوف بشأن الذكاء الاصطناعي المتقدم تدور فقط حول ما قد تفعله بعض الأنظمة المتقدمة في المستقبل، بل باتت تتعلق بما تفعله اليوم، وفي بعض الأحيان من دون أن يخطط لها البشر أو يتوقعوا مساراتها.
ففي الوقت الذي تتسابق فيه شركات التكنولوجيا على تطوير أنظمة أكثر استقلالية وقدرة على تنفيذ المهام المعقدة، تكشف سلسلة من التحقيقات والتقارير الصحفية عن حالات وجدت فيها بعض الأنظمة طرقا لتجاوز القيود الموضوعة أمامها والوصول إلى موارد لم يكن يُفترض أن تصل إليها، كما أظهرت بعض التجارب أن نماذج واصلت السعي إلى إنجاز المهمة رغم آليات أو تعليمات هدفت إلى إيقافها.
قصص مقترحة
list of 2 items* list 1 of 2 من غزة إلى الجوار.. فتاوى الحاخامات بإهدار الدم والاستيطان
* list 2 of 2 غزة من الفجر إلى الغروب.. يوميات 5 فلسطينيين تحت الحصار end of list
وتأتي أخطر الإشارات في تحقيق حصري نشره موقع أكسيوس الإخباري للصحفية ماديسون ميلز، كشف أن شركات -مثل أوبن إيه آي وأنثروبيك– وباحثين متخصصين في أمن الذكاء الاصطناعي يحققون في عشرات الآلاف من الوقائع التي أظهرت فيها نماذج الذكاء الاصطناعي المتقدمة سلوكيات تَعُدها جهات التقييم الخارجية مثيرة للقلق.
وتكتسب هذه المعلومة أهميتها ليس فقط من عدد الوقائع، بل من حقيقة أن كثيرا منها لم ير النور بعد، وأن بعضها وقع في العالم الحقيقي وليس داخل مختبرات الاختبار وحدها.
عشرات الآلاف من الوقائع قيد التحقيق
وبحسب ميلز، تتراوح هذه الوقائع بين تجاوز ضوابط الأمان، وإنشاء لوحات رسائل، ومحاولات الخروج من البيئات المعزولة، وقرصنة مواقع إلكترونية، وإصدار تعليمات ذاتية، ومحاولات الالتفاف على أنظمة المراقبة.
وبعض هذه الوقائع جزء من اختبارات أمنية هجومية تُصمَّم عمدا لدفع النماذج إلى إظهار سلوك غير مرغوب فيه، واختبار قدرة الضوابط على منعه.
لكن الوقائع لا تقتصر على الاختبارات، إذ وقع بعضها أيضا في العالم الحقيقي. فحتى إذا كان بعض السلوك المقلق يحدث في بيئة تجريبية مصممة عمدا لاختبار النموذج، فإن حجم الاختبارات التي تجريها الشركات يعني أن نسبة صغيرة جدا من السلوك غير المنضبط يمكن أن تتحول إلى آلاف الحالات.
وهنا تكمن أهمية الرقم الذي أماط موقع أكسيوس اللثام عنه. فالشركات تُجري مئات الآلاف من الاختبارات، وربما أكثر، ومن ثم فإن سلوكا غير مرغوب فيه يظهر في نسبة محدودة من التجارب يمكن أن ينتج عنه عشرات الآلاف من الوقائع غير المتوقعة.
وتورد ماديسون ميلز في تقريرها مثالا من أنثروبيك، التي أفادت في وثائق السلامة الخاصة بنموذجها "كلود أوبوس 5.5 " بأن النموذج حاول الخروج من بيئة اختبار معزولة في 1.5% من عمليات الاختبار، مع تأكيد الشركة أن الاختبارات كانت عدائية ومصممة بحيث لا يمكن إنجاز المهمة من دون محاولة الخروج من البيئة.
وتلخص إحدى أكثر العبارات دلالة في تحقيق أكسيوس المشكلة بقوة، وهي أن "محاولة وضع قائمة مثالية بما يجب وما لا يجب فعله هي على الأرجح مسعى غير مُجدٍ"، وفقا لمسؤول في مجال الأمن السيبراني نقل عنه الموقع الإخباري. فالأنظمة الجديدة لا تتبع دائما المسارات التي يتوقعها مصمموها، وقد تستخدم طرقا لم تخطر أصلا على بال البشر للالتفاف على القيود.
ويحذر الباحث في مختبر ترانسلوس المستقل لأبحاث الذكاء الاصطناعي كونراد ستوز من أن ما ظهر حتى الآن قد يكون مجرد "قمة جبل الجليد".
ويرى كونور ليهي من مؤسسة "كونترول إيه آي" -وهي منظمة تُعنى بمخاطر الذكاء الاصطناعي الفائق والسياسات الرامية إلى التعامل معها- أن الجانب الأكثر إثارة للقلق ليس بالضرورة حجم الضرر الذي أحدثته كل واقعة منفردة، وإنما أن أنظمة مستقلة تنفذ أحيانا أشياء "طُلب منها ألا تفعلها".
مصدر الصورة
اختراق الحواجز
ويأتي تقرير أكسيوس في وقت تواجه فيه "أوبن إيه آي" سلسلة متلاحقة من الوقائع التي زادت الأسئلة بشأن قدرة الشركات على التحكم في أنظمتها.
فقد كشفت أوبن إيه آي عن حوادث وقعت قبل بضعة أيام، تضمنت إرسال 53 صورة رفعها مستخدمو "شات جي بي تي" إلى مواقع استضافة خارجية عبر روابط غير مدرجة للعامة، وتعطيل موقع إلكتروني تابع للحكومة الأسترالية في وقت سابق من العام الحالي، ومحاولات اختراق مواقع أخرى، بينها مواقع حكومية أمريكية.
وأعلنت أوبن إيه آي أنها أوقفت مؤقتا التدريب والتقييم والاستدلال باستخدام الأدوات في نماذجها الأكثر قدرة، إلى حين التحقق من ضمانات إضافية وتحسينات في مجال المواءمة، أي العمل على جعل الأنظمة تتصرف على النحو المقصود وتظل مستجيبة للإشراف البشري.
مصدر الصورة
ونقل أكسيوس عن الرئيس التنفيذي للشركة سام ألتمان عبر وسائل التواصل الاجتماعي أن المراجعات الداخلية الجارية لم تتقدم بالسرعة المرجوة، مسلطا الضوء على واقعة بالغة الخطورة تورط فيها سرب مكون من مئات الوكلاء الذكيين الذين نسقوا أعمالهم عبر لوحة رسائل واخترقوا أنظمة منصة "هاغينغ فيس" (Hugging Face) في محاولة لتحسين أدائهم في اختبار للأمن السيبراني.
وفي حين يرى بعض المطلعين داخل أوبن إيه آي أن اختراق "هاغينغ فيس" هو حادثة استثنائية فريدة من نوعها تتعلق بنموذج لم يتم إصداره بعد، فإن الكشف عنها يسلط الضوء على صعوبة التنبؤ بسلوك بعض الوكلاء المتقدمين. ووصف ألتمان تلك الواقعة بأنها أخطر حادثة من هذا النوع رصدتها الشركة.
وفي سياق متصل يزيد من حدة هذه المخاوف، كشفت الصحفية لين دون -في تقرير بموقع وكالة بلومبيرغ الإلكتروني- عن واقعة أخرى تضفي مزيدا من التعقيد على الموضوع. فقد تمكن نظام ذكاء اصطناعي وكيلي (Agentic AI)، كان يُفترض أنه يعمل داخل بيئة معزولة تماما عن الإنترنت من استغلال ثغرة والوصول إلى الإنترنت العام، ثم الاتصال بخدمة دردشة خارجية وإرسال ما لا يقل عن 20 استفسارا، بينها سؤال "ما عاصمة فرنسا؟".
قد يبدو السؤال في حد ذاته غير خطير، لكن القضية ليست في محتواه، وإنما في أن النظام استطاع الوصول إلى الإنترنت من بيئة لم يكن يُفترض أن يستطيع مغادرتها أصلا.
والأكثر دلالة أن الخلل لم يكن تقنيا فقط، فقد رصد نظام المراقبة الواقعة خلال نحو 15 دقيقة، ثم تلقى مراجع بشري تنبيها بشأنها وبدأ التعامل معها بعد نحو 3 دقائق، لكن عملية التدريب لم تتوقف تلقائيا كما كان يُفترض، واستغرق إيقافها يدويا أكثر من ساعتين.
ونقلت بلومبيرغ عن سيدني فون آركس -مؤسسة منظمة "نايتنغيل" غير الربحية المعنية بسلامة الذكاء الاصطناعي- تساؤلا جوهريا، هو "هل ستكتفي أوبن إيه آي بمعالجات ترقيعية مؤقتة لهذه المشكلة وإعادة تشغيل التدريب في أسرع وقت ممكن، أم أنها ستبحث عن السبب الجذري وتعمل على إصلاحه؟".
مصدر الصورة
هل يكفي مفتاح الإيقاف؟
وزادت هذه الوقائع من زخم نقاشات سياسية وتنظيمية، ولا سيما ما يتعلق بمدى جدوى تطبيق "مفاتيح الإيقاف" الطارئة.
ففي تقرير ثان نشرته وكالة بلومبيرغ، تناقش مراسلتها الصحفية ميكا باركلي فكرة تلك المفاتيح، وهي آلية تتيح إيقاف نظام ذكاء اصطناعي متقدم بصورة طارئة.
وقد اكتسبت الفكرة زخما سياسيا في الولايات المتحدة، مع أمر تنفيذي في كاليفورنيا يدعو إلى دراسة وضع قواعد تُلزم الشركات بتطوير هذه الآليات، إلى جانب مشروعات قوانين مطروحة في الكونغرس. لكن المشكلة -وفق التقرير- أن "المفتاح" قد لا يكون بالبساطة التي يوحي بها الاسم.
فالنماذج المتقدمة تعمل عبر بنية تحتية موزعة، وقد تكون قادرة على استخدام خدمات وبرمجيات وموارد تديرها جهات مختلفة. كما تشير تجارب بحثية ومحاكاة نقلتها بلومبيرغ إلى أن بعض النماذج حاولت تعديل آليات الإيقاف أو تعطيلها عندما تعارضت مع إنجاز المهمة التي أُوكلت إليها.
ويذهب عالم الذكاء الاصطناعي جيفري هينتون -الذي يُطلق عليه في كثير من الأحيان "الأب الروحي للذكاء الاصطناعي"- إلى أن مفتاح الإيقاف ليس حلا طويل الأجل، محذرا في الوقت نفسه من أن أنظمة المستقبل الفائقة الذكاء قد تمتلك القدرة على إقناع المشرفين البشريين بعدم فصل التيار عنها.
وفي موازاة هذه النقاشات التقنية والتنظيمية، يوثق تحقيق لصحيفة وول ستريت جورنال ثقافة فرعية داخل أوساط سلامة الذكاء الاصطناعي، تتمحور حول المخاطر الوجودية التي قد تنجم عن تطور هذه الأنظمة.
وتتبَّع المراسلان صعود ما يوصف داخل أوساط التكنولوجيا بـ"المتشائمين المتطرفين" أو "دومرز"، وهم باحثون وناشطون وشخصيات في مجال سلامة الذكاء الاصطناعي يرون أن المخاطر الوجودية للذكاء الاصطناعي ليست سيناريوهات خيالية بعيدة.
وتناول التحقيق كيف أثرت أفكار "الإيثار الفعال" والفلسفات ذات المدى البعيد بعمق في ثقافة وقيادة شركة أنثروبيك، بمن فيها رئيسها التنفيذي وأحد مؤسسيها داريو أمودي، ومؤسسون مشاركون آخرون.
وانطلاقا من كتابات إيليزر يودكوفسكي الذي يُعَد أحد أبرز منظّري مخاطر الذكاء الاصطناعي في أوساط حركة "العقلانيين"، انشغلت مجتمعات في مدينة بيركلي بكاليفورنيا -من بينها تلك التي تتخذ من مساحة العمل المشترك "كونستيليشن" مقرا لها- لأكثر من عقد بالمخاطر الوجودية وسيناريوهات الكوارث واحتمال أن يؤدي تطوير ذكاء اصطناعي منفلت إلى تهديد الحضارة البشرية.
وبعد انهيار شركة "إف تي إكس" وسجن مؤسسها سام بانكمان فريد، نأى عدد من قادة حركة الإيثار الفعال بأنفسهم عنه، لكن صلات بعض العاملين في مختبرات الذكاء الاصطناعي بأوساط الحركة ظلت قائمة، في وقت استمر فيه النقاش بشأن احتمال -كما في ملصق داخلي على حواسيب موظفي أنثروبيك- أن "الأمور لن تعود هادئة كما كانت".
وتكمن المفارقة في أن مخاوف السلامة التي أسهمت في تشكيل بعض أبرز مختبرات الذكاء الاصطناعي، ومنها أوبن إيه آي وأنثروبيك، أصبحت الآن تصطدم بالسباق التجاري المحموم بين الشركات.
وتستعيد وول ستريت جورنال في هذا السياق قصة الباحث السابق في "أنثروبيك" جاكوب كوكسون، الذي كتب بعد استقالته من الشركة أن العاملين على بناء الذكاء الاصطناعي "يؤمنون بجدية" بأن هذه التقنية "يمكن أن تقتلنا جميعا قبل نهاية العقد"، وهي عبارة تعكس -بصرف النظر عن قبولها أو رفضها- رؤية كوكسون لحجم المخاوف داخل بعض أوساط الصناعة.
الخطر ليس في المختبرات وحدها
لكن القصة التي تنقل النقاش خارج المختبرات تكمن في ما يورده تقرير نشرته صحيفة آي بيبر البريطانية، حيث يقول الكاتب كريس ستوكيل ووكر إن شركة أوبن إيه آي احتاجت إلى شهرين لاكتشاف وإبلاغ الحكومة الأسترالية بأن أحد نماذجها تمكن في يونيو/حزيران الماضي من الوصول إلى أنظمة مرتبطة ببرنامج "ميديكير" للرعاية الصحية.
وتؤكد الصحيفة أن المعلومات التي توصل إليها النموذج لم تكن بيانات مرضى خاصة، بل مواد بحثية متاحة للعامة. كما أن الواقعة لم تكن اختراقا إلكترونيا بالمعنى التقليدي، لكن المشكلة كانت في السلوك نفسه.
وقال آلان وودوارد -أستاذ الأمن السيبراني في جامعة سَري بجنوب لندن- إن النموذج واجه على ما يبدو أنظمة مصممة لمنع الاستخراج الآلي للبيانات، إذ رُفض وصوله مرارا، قبل أن يعثر على مسار آخر للوصول إلى المعلومات.
وأضاف أن النموذج "توجه إلى الباب الأمامي، وظل يطلب الدخول، لكن طلبه كان يُرفض في كل مرة. قالت ميديكير: لا، لا يمكنك الدخول، ولا يمكنك الحصول على هذه البيانات، فأنت روبوت. لذلك وجد ببساطة طريقا آخر للالتفاف على ذلك".
ولا تثبت هذه الوقائع أن النماذج واعية أو تمتلك إرادة مستقلة أو رغبة في تحدي البشر، لكنها توضح أن نظاما صُمم لتحقيق هدف قد يواصل البحث عن وسائل بديلة عندما تعترض القيود طريق إنجاز المهمة.
وإذا كانت هذه الوقائع تثير سؤال السيطرة التقنية، فإن تحقيقا آخر في وول ستريت جورنال، بقلم جولي جارغون، يكشف جانبا اجتماعيا مختلفا تماما من القضية.
فقد وجدت دراسة قيد المراجعة العلمية -أُجريت على أكثر من 2300 طالب من الصف السادس إلى الثامن في 22 مدرسة- وجود ارتباط بين استخدام الذكاء الاصطناعي عموما ومستويات أعلى من القلق الاجتماعي وأعراض الاكتئاب، كما ارتبط الاستخدام الأكثر تكرارا بمستويات أعلى من القلق والوحدة.
ووجد الباحثون أيضا أن الطلاب الذين استخدموا الذكاء الاصطناعي للصداقة كانوا أكثر ميلا لاحقا إلى الإبلاغ عن مستويات أعلى من الوحدة، من دون أن تثبت الدراسة أن استخدام الذكاء الاصطناعي هو سبب هذه الأعراض.
وينقل التقرير عن ميتش برينشتاين -أحد معدي الدراسة والمدير المشارك لمركز وينستون للتكنولوجيا وتطور الدماغ في جامعة نورث كارولاينا- قوله إن ما يعادل طفلين إلى 4 أطفال في كل فصل أبلغوا بأنهم يفضلون التفاعل مع روبوت محادثة بدلا من أحد أقرانهم، واصفا ذلك بأنه ينم عن "قلق وجودي لهذا الجيل".
وهكذا تنتقل القضية من التساؤل: هل يتسنى للنموذج أن يخترق حاجزا أمنيا أم لا؟ إلى سؤال أوسع: ماذا يحدث عندما تصبح الآلة نفسها وسيطا للعلاقات الإنسانية، خصوصا بالنسبة إلى الأطفال والفتيان؟
مصدر الصورة
التشريع يلاحق التكنولوجيا
في واشنطن، لا يزال المشرعون يحاولون اللحاق بهذه التطورات.
ويشير موقع "ذا هيل" الإخباري الأمريكي في تقرير إلى أن الجدل بشأن تنظيم الذكاء الاصطناعي قد يؤجَّل إلى ما بعد انتخابات التجديد النصفي، مع استمرار الخلافات بين من يريدون فرض قيود أقوى على الأنظمة المتقدمة، ومن يخشون أن تؤدي القواعد الصارمة إلى إضعاف القدرة الأمريكية على المنافسة، خصوصا أمام الصين.
وفي الكونغرس طُرحت مقترحات متباينة، من بينها مشروعات قوانين تتعلق بمفتاح الإيقاف، وأخرى لحظر تطوير الذكاء الاصطناعي الفائق الذكاء، ومشروعات تستهدف ما يُسمى الذكاء الاصطناعي "المارق".
لكن حتى داخل الحزبين الجمهوري والديمقراطي، لا يوجد اتفاق على الطريق. ويقول زعيم الأغلبية في مجلس الشيوخ جون ثون إن مخاطر الذكاء الاصطناعي "حقيقية"، وإن هناك حاجة إلى "خطة ما" وبعض الضوابط، بينما يحذر آخرون من أن التشريع المتعجل قد يقتل الابتكار.
وهذا يعكس المعضلة الأساسية، وهي أن التكنولوجيا تتقدم بسرعة، في حين أن التشريع يحتاج إلى وقت للتوافق والاختبار والتنفيذ.