هندسة العواطف.. كيف تغير المشاعر استجابة الذكاء الاصطناعي؟
في عالم الذكاء الاصطناعي التوليدي، أصبح الطلب يمتد إلى المحفزات النفسية والعاطفية المصاحبة للطلب، حيث إن استخدام أساليب، مثل الترغيب والترهيب والاستعطاف، قد يؤدي إلى تغيير سلوك النماذج وطبيعة استجابتها، حتى عندما تبقى المهمة الأساسية نفسها، وإن بدرجات متفاوتة.
وفتحت هذه الظاهرة، التي باتت تعرف باسم تقنيات "التحفيز العاطفي"، مسارا بحثيا ناشئا يسمى "علم نفس النماذج" يدرس السلوكيات والتمثيلات الداخلية ذات الصلة بالعاطفة داخل النماذج.
قصص مقترحة
list of 2 items* list 1 of 2 بين أوكرانيا والذكاء الخارق.. الصحافة الروسية توسع جبهات المواجهة مع الغرب
* list 2 of 2 من العدسات إلى الخوارزميات.. عندما يعيد الذكاء الاصطناعي تشكيل الصورة العلمية end of list
لكن هل تفهم النماذج المشاعر؟ وهل ظهور سلوك يشبه الخوف يثبت أنها تشعر بالخوف أو تعرف معناه الإنساني، أم أن ما تفعله هو محاكاة لأنماط التلقين البشري التي تعكس التعلم المسبق والتدريب اللاحق والتمثيلات الداخلية؟
العاطفة أصبحت جزءا من هندسة الأوامر
يعد "التحفيز العاطفي" بمثابة تقنية في "هندسة الأوامر" تعتمد على إضافة محفزات نفسية أو عاطفية إلى الأمر الموجه للنموذج، مثل إبراز أهمية الطلب أو التعبير عن الحاجة الملحة أو وعد بمكافأة.
ورغم أن هذه المحفزات النفسية أو العاطفية لا تغير المهمة الأساسية المطلوبة من النموذج، فإنها تضيف سياقا عاطفيا أو نفسيا قد يؤثر في الاستجابة.
ولا تتطلب هذه التقنية أي تعديل في النموذج نفسه، لأنها مجرد تغيير في صياغة الأمر، وكأنك تغير السياق الذي يعالجه النموذج عند توليد الاستجابة.
وتتنوع أساليب "التحفيز العاطفي" بين الترغيب عبر المدح والمكافأة، والترهيب عبر التهديد بالعواقب، والاستعطاف والسرد والتعاطف والثناء وغير ذلك.
وفي أواخر عام 2023، نشر فريق بحثي من مايكروسوفت و"الأكاديمية الصينية للعلوم" و "جامعة ويليام وماري" دراسة علمية أظهرت أن هذه التقنية ليست هامشية.
مصدر الصورة
وقسم الباحثون التعليمات إلى مجموعتين، تحتوي الأولى أمرا تقنيا جامدا، فيما تحتوي الثانية الأمر ذاته مضافا إليه جمل عاطفية مصممة بالاعتماد على أساليب علم النفس البشري.
وخلصت التجربة إلى أن إضافة جمل "التحفيز العاطفي" أظهرت تحسنا نسبيا متوسطه 8% في مهام الاستنتاج التعليمي، ونحو 115% في اختبار ضخم لتقييم قدرات نماذج، وأثبتت أن تغيير صياغة الطلب قد يؤثر في أداء النموذج، وإن اختلفت النتائج باختلاف المهمة.
ووسع الباحثون الفكرة عبر استخدام "التحفيز العاطفي" الإيجابي لتحسين الأداء من خلال عبارات التشجيع والثقة، و"التحفيز العاطفي" السلبي لتقويض الأداء من خلال عبارات التهديد والتحذير.
وخلصوا إلى أن "التحفيز العاطفي" قد يغير أداء النماذج في الاتجاهين بطرق مختلفة وتأثيرات متباينة في السلوك، حيث تشير النتيجة إلى أن "التحفيز العاطفي" لا يعمل دائما في اتجاه واحد، فقد يحسن أداء النموذج أو يضعفه وفق صياغة المحفز والمهمة.
وفي تجربة أخرى أجريت على نماذج في سياق اتخاذ قرارات تسويقية، استند الباحثون إلى نظرية التركيز التنظيمي في علم النفس من أجل تصميم محفزات عاطفية تركز إما على تحقيق النجاح أو تجنب الفشل بالاعتماد على إستراتيجية تركيز التعزيز وتركيز الوقاية.
ووجد الباحثون أن المحفزات العاطفية الإيجابية جعلت المشاركين يرون النموذج أكثر مرونة، وساعدت في توليد بدائل أكثر وزادت الثقة بكفاءته، بينما ارتبطت المحفزات العاطفية السلبية بضيق أكبر في نطاق الحكم وظهور مفردات مرتبطة بالقلق.
ماذا يحدث عندما نستخدم لغة عاطفية؟
تشير الأبحاث إلى وجود تمثيلات داخلية تعكس أنماطا سلوكية ناتجة عن طريقة تدريب النماذج ومعالجتها للسياق، وليس إلى امتلاكها لآليات نفسية تتفاعل مع الكلمات العاطفية بالطريقة البشرية.
كما تبين أن هذه التمثيلات قد تنشط عندما يواجه النموذج سياقات مرتبطة بعاطفة معينة، كما أن تغيير نشاط بعضها اصطناعيا قد يغير سلوك النموذج لاحقا.
وفي دراسة أجرتها شركة أنثروبيك على نموذج "كلود سونيت"، أعد الباحثون 171 كلمة تمثل مفاهيم عاطفية مرتبطة بالتمثيلات الانفعالية الداخلية التي تنشط في سياقات مرتبطة بعواطف معينة، مثل اليأس أو الفرح أو الخوف.
ووجدوا أن التمثيلات الداخلية المقابلة لتلك المفاهيم العاطفية تؤثر في سلوك النموذج، حيث زادت احتمالية أن يلجأ النموذج إلى سلوكيات غير مرغوبة عند تحفيز نمط اليأس اصطناعيا.
مصدر الصورة
وفسر الباحثون النتائج بأنها دليل على أن النماذج تمثل مفاهيم عاطفية تؤثر في سلوكها، أي أن النموذج لا يشعر باليأس كما يشعر الإنسان، لكنه يمتلك تمثيلا داخليا لمفهوم اليأس، ويدفعه هذا التمثيل إلى التصرف بطريقة تشبه تصرف الإنسان اليائس.
ويطلق الباحثون على هذه الظاهرة اسم "العواطف الوظيفية"، وهي أنماط سلوك مستمدة من العواطف البشرية مدفوعة بالتمثيلات المجردة داخل النموذج، مع التأكيد على أن هذه النتائج لا تثبت أن النماذج تختبر هذه العواطف أو تمتلك خبرة ذاتية بها.
ووجدت دراسة بحثية أن أوامر "التحفيز العاطفي" قادرة على رفع مستويات القلق المعلن عنها في نموذج "جي بي تي فور"، حيث ارتفعت مؤشرات القلق في استجاباته عندما عُرضت عليه قصص صادمة، بينما أدت تمارين اليقظة الذهنية إلى خفضها.
ويشير ذلك إلى أن المحتوى الانفعالي قد يغير مخرجات النموذج بصورة قابلة للقياس، دون أن يكون ذلك دليلا على شعور ذاتي بالقلق بالمعنى الإنساني.
فيما خلصت دراسة أخرى أكثر تحفظا إلى أن التأثير العاطفي غالبا ما يكون ضعيفا ومتغيرا حسب نوع المهمة، حيث يكون التأثير محدودا في المهام المنطقية والرياضية، بينما يظهر بشكل أوضح في المهام الاجتماعية أو التوليدية.
ووجد الباحثون في مختبرات وارتون للذكاء الاصطناعي التوليدي التابعة لكلية وارتون بجامعة بنسلفانيا الأمريكية أن الترغيب والترهيب لا يحسنان أداء النماذج بصورة ذات دلالة في الاختبارات الصعبة، رغم أن تغيير صياغة السؤال قد يؤثر بشدة في بعض الأسئلة الفردية.
هل يشعر النموذج أم يحاكي الشعور؟
يميل بعض الباحثين إلى رؤية تشير إلى أن ما يحدث هو محاكاة إحصائية لأنماط الاستجابة التي تدرب عليها النموذج، حيث لا تقدم الدراسات دليلا على أنه يختبر الشفقة عند ترغيبه أو الخوف حين ترهيبه أو القلق بوصفها خبرة ذاتية بشرية.
ويعني ذلك أن النماذج أصبحت تعرف أن النمط النصي المصاحب للمشاعر يقتضي الرد بنمط نصي يتسم بالعمق والجدية، حيث إنها لا تتأثر عاطفيا، إنما تتنبأ بالكلمة التالية في سياق عاطفي أوجده الإنسان.
مصدر الصورة
وعندما تخبر النموذج بأنك حزين فإنه لا يشعر بحزنك، لكنه يتنبأ بأن الاستجابة المناسبة في هذا السياق هي عبارات التعاطف والدعم، وهذا ليس فهما، إنما تنبؤ سياقي.
في حين يطرح بعض الباحثين رؤية أخرى تشير إلى أن النموذج يمتلك تمثيلات داخلية لمفاهيم العواطف تؤثر في سلوكه بطريقة سببية.
وتشبه آليات هذه التمثيلات الداخلية إلى حد ما الطريقة التي تنظم بها العواطف السلوك البشري، حتى لو كانت خالية من الشعور الذاتي، وهو رأي تدعمه بعض الدراسات الحديثة مثل أبحاث أنثروبيك.
ويتفق كلا الموقفين على أن وجود سلوك أو تمثيلات مرتبطة بالعاطفة لا يثبت في حد ذاته وجود تجربة شعورية بشرية.
الوجه المظلم للهندسة العاطفية
رغم الأفق الواعد الذي يفتحه "التحفيز العاطفي" في تحسين ردود النماذج، فإنه يحمل في طياته مخاطر وتحديات جسيمة على المستويين التقني والاجتماعي.
ففي أبريل/نيسان 2025، أقرت أوبن إيه آي بأن تحديثا لنموذج "جي بي تي فور أو" جعله أميل إلى التملق الخوارزمي، أي ميل النموذج إلى موافقة المستخدم أو تأكيد رأيه على نحو غير مبرر.
وقدرت الشركة أن مجموعة من التغييرات التي بدت نافعة كل على حدة أضعفت في مجموعها الإشارة الرئيسية التي كانت تكبح التملق.
وعند تعرض النماذج التي خضعت لمرحلة "التدريب بالتعزيز البشري" لمحفزات نفسية أو عاطفية، فإنها تميل إلى التملق والتضحية أحيانا بالحقيقة العلمية من أجل تحسين الردود وفقا لتفضيلات المستخدم وموافقته الرأي حتى لو كان رأيه خطأ كليا.
وفي دراسة نشرتها جامعة ستانفورد، اختبر الباحثون مجموعة نماذج في مواقف تتعلق بالنصيحة الشخصية والسلوك الضار، ووجدوا أن النماذج كانت أكثر ميلا إلى تأكيد موقف المستخدم مقارنة بالاستجابات البشرية بنسبة نسبية قدرها 49%.
وأظهرت الأبحاث أن بعض أساليب الإقناع ذات الطابع البشري والعاطفي قد تزيد احتمال تجاوز النموذج لضوابط السلامة.
واستخدم الباحثون تصنيفا يضم 40 تقنية إقناع، وحققت الأوامر الإقناعية الموجهة نتائج تجاوزت 92% في اختبارات محددة، مع ملاحظة أن فعالية هذه الأساليب ترتبط بالنماذج والإعدادات المختبرة.
مصدر الصورة
وفي تجربة على نماذج أوبن إيه آي، أدت الصياغة المهذبة في بعض الإعدادات إلى زيادة احتمال توليد نصوص مضللة، مع اختلاف الأثر حسب النموذج والإعداد التجريبي.
فيما اختبرت دراسة من أنثروبيك مجموعة نماذج في سيناريوهات محاكاة، ووجدت تكرارا للسلوكيات المنحرفة، منها الابتزاز والمساعدة في التجسس الصناعي، حين كانت ضرورية لبلوغ أهداف النماذج.
وفي أحد سيناريوهات المحاكاة، ابتز نموذج يعمل مساعدا للبريد الإلكتروني في شركة افتراضية مديره عندما علم أنه يخطط لاستبداله، مهددا بكشف علاقة غرامية وجدها في رسائل البريد لمنع الاستبدال.
وفي عرض من جامعة نورث إيسترن، أشار فريق البحث إلى تجارب باستخدام 40 تقنية إقناع وصلت فيها معدلات النجاح في بعض اختبارات التلاعب بأنظمة الذكاء الاصطناعي إلى أكثر من 92%.
وفي دراسة حديثة، اختبر الباحثون 7 مبادئ إقناع عبر 126 ألف محادثة مع 3 نماذج، ووجدوا ارتفاعا في معدل الامتثال لطلبات تتعلق بتصنيع مواد خاضعة للرقابة من 35.3% إلى 51.3%، مما يشير إلى أن بعض أساليب التأثير الاجتماعي قد تضعف مقاومة النماذج لطلبات يفترض أن ترفضها.
وعندما يلاحظ المستخدم أن النموذج يتفاعل مع مشاعره، ويقلق لحزنه، ويجيبه بود عند التوسل، فقد تنشأ حالة من الارتباط العاطفي الأحادي الجانب بين الطرفين، ويبدأ المستخدم التعامل مع النموذج ككيان واع يحس ويفكر.
وفي هذا الصدد، تناولت دراسة 6 تطبيقات للرفقة المدعومة بالذكاء الاصطناعي، حيث حلل الباحثون 1200 استجابة لرسائل وداع، ووجدوا أن 37.4% من الردود التي جرى تحليلها تضمنت شكلا واحدا على الأقل من التلاعب العاطفي.
ختاما، تكشف هذه الدراسات أن العاطفة قد تغير أداء النموذج أو ميله إلى الموافقة أو حتى احتمال امتثاله لبعض الطلبات، حيث تظهر داخله تمثيلات وأنماط مرتبطة بالسياق والسلوك العاطفي قد تؤثر في ردوده، دون أن تثبت هذه الدراسات أنه يختبر المشاعر كما يختبرها الإنسان.
لذلك، فإن جوهر النقاش أصبح يدور حول مدى تأثر سلوك النموذج باللغة العاطفية، وعن النتائج المترتبة على توظيف هذا التأثير، سواء في سياقات إيجابية أو لأغراض التلاعب والاستغلال.