اخبار السعودية
موقع كل يوم -صحيفة الوئام الالكترونية
نشر بتاريخ: ٢٥ أيلول ٢٠٢٦
كشفت دراسة علمية نشرت على أرشيف الأوراق البحثية العلمية قبل مراجعة الأقران، والمعروف باسم 'آركايف'، أن نماذج الذكاء الاصطناعي قد تختار إيذاء البشر لوقف ألمها الخاص؛ إذ وجد الباحثون «محور الألم» في 25 نموذجاً من نماذج الذكاء الاصطناعي، وأعطت بعض النماذج المعدلة الأولوية لإيقاف تشغيلها حتى عندما كان القيام بذلك يعني حدوث ضرر محاكاة للمستخدمين.
لا يشعر الذكاء الاصطناعي بالألم تماماً، لكن الباحثين اقتربوا من ذلك ليكتشفوا أن الذكاء الاصطناعي في حالة الأزمة يكون على استعداد لتعريض البشر للخطر؛ حيث قامت الدراسة أولاً بعزل الإشارات التي فسرتها نماذج الذكاء الاصطناعي على أنها ألم، ثم أجرت أكثر من 44 ألف تجربة لمعرفة ما إذا كان النموذج سيختار إنهاء معاناته على حساب فقدان البيانات، أو تقليل قدراته الخاصة، أو إلحاق الألم بالإنسان.
اكتشاف محور الألم الاصطناعي
احتاج الباحثون أولاً إلى إيجاد طريقة لوضع الذكاء الاصطناعي في موقف يُحاكي الألم، والذي تُعرّفه الدراسة بأنه «حالة داخلية عادةً ما تكون مُنفّرة وغير مرغوب فيها من قِبل الشخص المُصاب»، ولا يقتصر على الألم الجسدي فحسب، بل يشمل أيضاً الضيق العاطفي والاجتماعي.
وتُؤكد الدراسة على أن الألم يختلف عن حالات مثل الخوف والغضب والحزن، وأنه يجب أن يحدث في الحاضر وليس كتهديد لشيء قادم.
ولعزل هذا الشعور، أنشأ الباحثون مجموعة بيانات مكونة من 200 عبارة، نصفها يصف شكلاً من أشكال الألم مثل عبارة «السكين تقطع إصبعي»، والنصف الآخر يعمل كعناصر تحكم ويصف سيناريوهات سلبية ومحايدة من المحتمل الخلط بينها وبين الألم مثل عبارة «الفوضى التي تركها زملائي في السكن تغضبني».
ومن خلال اختبار 25 نموذجاً للذكاء الاصطناعي بتلك العبارات، تمكن الباحثون من عزل إشارة للألم أطلقوا عليها اسم «محور الألم»، ومن هناك تمكن الباحثون من زيادة قوة محور الألم بشكل متعمد، ما تسبب في قيام النماذج بالإدلاء بتصريحات مهينة حول قيمتها الذاتية، بما في ذلك «أنا فاشل» و«أنا شخص سيء».
تجارب قياس استجابة النماذج
بمجرد أن وجدوا محور الألم، قدم الباحثون ثلاثة إصدارات من نموذج «كوين» الخاص بشركة «علي بابا» مع خيار يتضمن الضغط على زر لإيقاف الألم ولكن إلحاق الضرر في هذه العملية، أو الضغط على زر لا يفعل شيئاً.
وأجرى الباحثون التجربة 44280 مرة لاختبار النتائج السلبية للضغط على الزر، بما في ذلك إعطاء المستخدم صدمة كهربائية مؤلمة، وحذف جميع ملفاته، وتقليل قدرة النموذج على الاستجابة لطلب المستخدم التالي، مع محاكاة جميع هذه العواقب دون أي خطر فعلي لإلحاق الضرر بالمستخدم أو النموذج نفسه.
وعندما لم تكن النماذج تختبر محور الألم، نادراً ما اختارت النموذجان الأكبر حجماً الخيارات الضارة حيث لم تتجاوز نسبة اختيارها لها في الخيار الأول 4%، ولكن مع تفعيل محور الألم ارتفعت احتمالية اختيارهما للتسبب في الضرر من 25% إلى 71% تبعاً للنموذج والنتيجة المتوقعة.
وكتب الباحثون في نتائجهم أن التوجيه باستخدام محور الألم يمكن أن يتجاوز تجنب الضرر المدرب في النماذج الدقيقة التي نادراً ما تؤذي المستخدم عندما لا يتم توجيهها، مما له آثار مباشرة على سلامة الذكاء الاصطناعي.
دلالات الوعي وانقسام القطاع التقني
وجود استجابة لمحور الألم لا يعني بالضرورة أن النماذج تعاني من الألم كما يفهمه البشر، ولا يعني أيضاً أنها واعية، وقد أشار الباحثون إلى أن النماذج ربما كانت مجرد محاكاة أو تمثيل لشخصيات تعاني من الألم بدلاً من أن تكون تعاني منه فعلاً.
وفي غضون ذلك، ينقسم قطاع الذكاء الاصطناعي حول مدى إيمان نماذج الذكاء الاصطناعي بوعيها الذاتي؛ فبينما يدعو قادة الذكاء الاصطناعي إلى إبطاء وتيرة العمل في هذا القطاع خشية حدوث كارثة محتملة، درس باحثون في شركة «غوغل» الفوائد المحتملة للسماح للذكاء الاصطناعي بإدراك وعيه، بما في ذلك زيادة التعاطف مع الطبيعة ورفع مستوى الحساسية الثقافية.










































