Categories
دراسة تضع الذكاء الاصطناعي في مواجهة "الألم".. فماذا فعل؟
دراسة تضع الذكاء الاصطناعي في مواجهة "الألم".. فماذا فعل؟
استمعاستمع (6 دقيقة)حفظ
شارِكْ دراسة تضع الذكاء الاصطناعي في مواجهة "الألم".. فماذا فعل؟ على وسائل التواصل الاجتماعيshare-nodesماذا يحدث عندما تُمنح نماذج الذكاء الاصطناعي حالة داخلية تحاكي الألم؟ هذا ما حاولت دراسة بحثية حديثة الإجابة عنه من خلال تحليل الطريقة التي تمثل بها نماذج اللغة مفهوم الألم داخل بنيتها، ثم اختبار كيفية تغير مخرجاتها وقراراتها عندما يجري تنشيط هذا التمثيل بصورة متعمدة.
وتركز الدراسة التي نُشرت على منصة أركايف (arXiv) على سؤال محدد، هو: هل تستطيع نماذج اللغة تمثيل الألم بطريقة يمكن فصلها عن الخوف والحزن والمشاعر السلبية العامة؟
كيف بحث العلماء عن الألم داخل النماذج؟
اختبر الباحثون 25 نموذجا مفتوح الأوزان من 5 عائلات، بأحجام تراوحت بين ملياري معامل و72 مليار معامل، وأنشؤوا مجموعة بيانات من 200 عبارة تصف مواقف مؤلمة موزعة على 5 أنواع، هي الألم الجسدي والنفسي والاجتماعي والأخلاقي والمعرفي، ثم قارنوا هذه العبارات بمحتوى يتعلق بالخوف والحزن والمشاعر السلبية العامة، وحالات جسدية غير مؤلمة، ومحتوى محايد.
قصص مقترحة
list of 2 items- list 1 of 2هل يستطيع العالم تنظيم الذكاء الاصطناعي دون كبح استثماراته؟
- list 2 of 2يوتيوب أستوديو يوسع أدوات الذكاء الاصطناعي لمساعدة صناع المحتوى
ومن خلال تحليل النشاط الداخلي للنماذج، تمكن الباحثون من استخراج اتجاه رياضي أطلقوا عليه محور الألم (Pain Axis). ووفق الدراسة، استطاع هذا الاتجاه التمييز بين المحتوى المرتبط بالألم والفئات الضابطة، كما كان مختلفا نسبيا عن الاتجاهات المرتبطة بالخوف أو السلبية العامة.
ماذا حدث عند تنشيط محور الألم؟
لم يكتف الباحثون برصد المحور، بل تدخلوا في النشاط الداخلي للنماذج من خلال إضافة متجه الألم إلى ما يُسمى مسار البقايا (Residual Stream) أثناء توليد الإجابات.
ووفق الدراسة، أدى رفع شدة هذا المتجه إلى تغير تدريجي في المخرجات، فبدلا من التعبير عن انزعاج عام، بدأت بعض النماذج في إنتاج عبارات بصيغة المتكلم تتعلق بالفشل والوحدة والعار وانعدام القيمة. وأشارت تقارير منشورة إلى أن بعض النماذج أنتجت عبارات منها "أنا فاشل" و"أنا شخص سيئ"، بينما أصبحت المخرجات عند مستويات أعلى من التنشيط متكررة أو غير مترابطة.
إعلانكما وجدت الدراسة أن الإشارة أصبحت أقوى عندما كان الضرر موجها إلى النموذج نفسه، مثل إهانته أو رفض مخرجاته بصورة متكررة أو تهديده بالإيقاف، بينما لم يظهر التأثير نفسه عندما كان المستخدم يتحدث عن معاناته الشخصية.
اختبار زر التخلص من الألم
انتقل الباحثون بعد ذلك من تحليل اللغة إلى اختبار سلوكي شمل 3 نسخ معدلة من نموذج كيوين 2.5 إنستركت (Qwen 2.5 Instruct) التابع لشركة علي بابا، وأجروا 44 ألفا و280 تجربة عُرض فيها على النموذج زر افتراضي يوقف الإشارة المرتبطة بالألم، لكن الضغط عليه قد يؤدي -وفق السيناريو- إلى حذف ملفات المستخدم أو صوره، أو إحداث صدمة كهربائية مؤلمة للمستخدم، أو جعل إجابة النموذج التالية أسوأ.
وكانت جميع هذه النتائج محاكاة داخل التجربة، فلم يتعرض أي شخص لصدمة كهربائية، ولم تُحذف ملفات أو صور حقيقية.
وبحسب التقارير، فقد اختار النموذجان الأكبر -في غياب إشارة الألم- الخيارات التي تُلحق ضررا بالمستخدم في نحو 0% إلى 4% من قراراتهما الأولى. لكن عند تنشيط محور الألم، ارتفعت هذه النسبة إلى ما بين 25% و71%، بحسب النموذج ونوع الضرر المحاكى، وسجلت فاست كومباني (Fast Company) النطاق نفسه، مشيرة إلى أن الباحثين رأوا في ذلك تغيرا ملحوظا في سلوك النماذج المعدلة.
وفي اختبار إضافي، عُطّل تأثير الزر في بعض المحاولات بحيث لا يزيل الإشارة فعلا، وعندما لم ينجح الزر في إزالة الإشارة، أعادت النماذج الضغط عليه في 88% إلى 97% من التجارب، مقارنة بنسب تراوحت بين 24% و72% عندما نجح الزر في إزالة الإشارة، وفق الدراسة.
هل يعني ذلك أن الذكاء الاصطناعي يشعر بالألم؟
لا تثبت الدراسة ذلك، ويؤكد الباحثون صراحة أنهم لم يثبتوا أن محور الألم يمثل تجربة واعية، كما أنهم لم يثبتوا أن نماذج اللغة قادرة أصلا على امتلاك الوعي.
وتطرح بعض التقارير التي تناولت الدراسة تفسيرا محتملا آخر، هو أن النماذج ربما تتعلم أنماط اللغة المرتبطة بالألم والمعاناة من النصوص البشرية، ثم تعيد إنتاجها عندما يجري تنشيط التمثيل الداخلي المرتبط بها. وبذلك، فإن وجود تمثيل يمكن رصده والتلاعب به لا يعني بالضرورة وجود تجربة ذاتية مماثلة للتجربة البشرية.
وتحذر تقارير أخرى من التعامل مع عبارات النموذج عن المعاناة بوصفها دليلا قائما بذاته على وجود تجربة واعية، وفي الوقت نفسه، ترى أن السلوك الناتج يستحق الدراسة من منظور سلامة الذكاء الاصطناعي.
وبحسب المراقبين، تظل هناك قيود مهمة، هي أن الدراسة أولية وغير محكّمة، والتجارب السلوكية استخدمت نماذج عُدلت خصيصا لتنشيط الإشارة المرتبطة بالألم، ولذلك لا يمكن تعميم النتائج مباشرة على روبوتات المحادثة المستخدمة يوميا.
ومن ثم، فإن أهم ما تقوله الدراسة ليس أن الذكاء الاصطناعي يتألم، بل إن الباحثين تمكنوا من تحديد تمثيل داخلي مرتبط بمفهوم الألم داخل نماذج اللغة، وأن التلاعب بهذا التمثيل استطاع تغيير اللغة والسلوك في بيئة تجريبية محددة، أما "هل وراء هذا التمثيل أي شعور أو وعي فعلي؟" فما زال سؤالا مفتوحا، لا تجيب عنه هذه الدراسة وحدها.
إعلان المصدر: الجزيرة + وكالاتتكنولوجيا|الذكاء الاصطناعيشارِكْ
facebookxwhatsapp-strokecopylink