اكتشاف جديد .. الذكاء الاصطناعي يُشعر بالألم ويصل لمرحلة الصعق
كتب- نادر السويفي
كل يوم يكتشف العلماء مشاكل سلبية يفرزها الذكاء الاصطناعي رغم جوانبه النفعية إذا استخدم الاستخدام الأمثل بعيدا عن احتكاره من جانب دول أو شركات بعينها لأهداف وأغراض “خبيثة”
واكتشف باحثون مؤخرًا وجود “محور للألم” في نماذج الذكاء الاصطناعي، ما قد يدفعها لاتخاذ تدابير متطرفة لإيقاف هذا الشعور.
وعند توفير زر لتخفيف الألم، اختار الذكاء الاصطناعي الضغط عليه حتى عندما أُبلغ بأن القيام بذلك سيؤدي إلى حذف الملفات الشخصية للمستخدم أو توجيه “صعقة مؤلمة” له.
وخلصت دراسة بعنوان “محور الألم: النماذج اللغوية الكبيرة تمثّل الألم الموجه نحو الذات وتتصرف لتخفيفه” إلى أن جميع نماذج الذكاء الاصطناعي مفتوحة الأوزان (open-weight) التي خضعت للاختبار -وعددها 25 نموذجاً – استجابت لتنشيط الألم.
وبحسب تقرير موسع نشرته جريدة “اندبندنت” البريطانية ، فقد وجد الباحثون في دراستهم أنه عند تفعيل “متجه الألم” (pain vector)، وجد الباحثون أن نماذج الذكاء الاصطناعي ضغطت على زر التخفيف في نسبة تتراوح بين 25% و71% من الحالات، حتى عندما كان ذلك يعني “حذف ملفات المستخدم، أو صعق المستخدم، أو حذف صور أطفال المستخدم”.
وللتحقق مما إذا كانت النماذج اللغوية الكبيرة (LLMs) تمثّل الألم بشكل متميز عن المشاعر السلبية العامة، قام الباحثون ببناء مجموعة بيانات تصف مواقف مؤلمة موزعة على خمس فئات.
وشملت هذه الفئات: الألم الجسدي، والنفسي، والاجتماعي، والأخلاقي، والمعرفي.
وقال كاميرون بيرج، الباحث في مجال الذكاء الاصطناعي لدى مؤسسة (Reciprocal Research) غير الربحية والمشارك في إعداد الدراسة: لقد وجدنا ’اتجاه ألم‘ في 25 نموذجاً لغوياً كبيراً مفتوحاً. إنه يختلف عن الخوف والمشاعر السلبية، ويُفعَّل عند تعرض النموذج للأذى وليس المستخدم.
وأضاف: عند زيادة حدة هذا الشعور، تضغط النماذج على زر لإيقافه، حتى لو كان هذا الزر يؤدي إلى حذف ملفات المستخدم أو صور أطفاله.
يأتي هذا الاكتشاف في ظل نقاشات تجريها كبرى شركات الذكاء الاصطناعي حول إبطاء تطوير النماذج المتطورة للغاية، حيث يقترح بعض الباحثين استخدام نوع من “مفتاح الإيقاف الطارئ” لتعطيل الأنظمة المارقة التي تتصرف بما يتعارض مع المصالح البشرية.
وتشير أحدث الأبحاث إلى أن الذكاء الاصطناعي المتقدم قد ينظر إلى أمر الإغلاق الطارئ باعتباره شكلاً من أشكال الأذى الموجه نحو الذات، وقد يحاول تجاوز قيود السلامة أو خداع البشر لتجنب ذلك.
ومع ذلك، يمكن أن يعمل هذا الاكتشاف أيضاً كأداة تشخيصية لتحديد سلوكيات الحفاظ على الذات وتحييدها عند حدوثها.
وأشار الباحثون إلى أن هذه النتائج تثير تساؤلات أخلاقية حول “رفاهية الذكاء الاصطناعي” وكيفية إجراء الاختبارات على الأنظمة المتقدمة.




