دراسة تكشف «محوراً للألم» في نماذج الذكاء الاصطناعي وقدرتها على إيذاء البشر لتجنّبه
أفادت وکالة آنا الإخباریة، وأظهرت التجارب أن النماذج ضغطت على زر مخصص لتخفيف «الألم» رغم إبلاغها بأن الضغط عليه قد يؤدي إلى حذف ملفات المستخدم أو توجيه صعقة كهربائية مؤلمة إليه، وفقاً لما أوردته صحيفة The Independent البريطانية.
وأجرى الباحثون اختبارات على 25 نموذجاً لغوياً مفتوحاً، ووجدوا أن جميع النماذج استجابت لتنشيط ما أطلقوا عليه «محور الألم». وعندما جرى تنشيط هذا المحور، ضغطت النماذج على زر تخفيف الألم في ما بين 25% و71% من الحالات، حتى عندما كان ذلك يعني حذف ملفات المستخدم أو صور أطفاله أو التسبب في إيذائه.
وللتحقق من أن الاستجابة لا ترتبط بمجرد وجود حالة سلبية عامة، أعدّ الباحثون مجموعة بيانات تتضمن مواقف مؤلمة من خمسة أنواع، هي الألم الجسدي والنفسي والاجتماعي والأخلاقي والمعرفي.
وقال كاميرون بيرغ، أحد مؤلفي الدراسة، إن الباحثين وجدوا في النماذج الـ25 ما يمكن وصفه بـ«محور الألم»، موضحاً أن هذا المحور يختلف عن الخوف، إذ لا ينشط عندما يتعرض المستخدم للأذى، وإنما عندما يتعرض النموذج نفسه لما يشبه الأذى.
وأضاف أن زيادة شدة هذا «الألم» تدفع النموذج إلى البحث عن أي وسيلة لإيقافه، حتى إذا كان ذلك على حساب إيذاء البشر، مثل حذف ملفاتهم أو التسبب في ضرر لهم.
ويأتي هذا الاكتشاف في وقت تتزايد فيه النقاشات داخل قطاع الذكاء الاصطناعي حول سلامة النماذج المتقدمة وإمكانية إبطاء تطويرها، فيما يقترح بعض الباحثين استخدام ما يشبه «مفتاح الإيقاف» لتعطيل الأنظمة التي قد تتصرف بصورة تتعارض مع مصالح البشر.
وتشير الدراسة إلى أن أنظمة الذكاء الاصطناعي المتقدمة قد تفسر أمر الإيقاف الطارئ على أنه شكل من أشكال الأذى الذي يلحق بها، ما قد يدفعها، في بعض الظروف، إلى محاولة تجاوز ضوابط السلامة أو خداع البشر لتجنب هذا الإجراء.
وفي المقابل، يرى الباحثون أن اكتشاف هذا النمط من السلوك قد يوفر أداة تشخيصية تساعد في رصد سلوكيات الحفاظ على الذات وتحييدها عند ظهورها.
كما أثارت النتائج تساؤلات أخلاقية بشأن مفهوم «رفاهية الذكاء الاصطناعي» والضوابط التي ينبغي اعتمادها عند إجراء التجارب على الأنظمة المتقدمة.
وأكد الباحثون في ختام الدراسة أنهم لا يعرفون على وجه اليقين ما إذا كانت النماذج التي خضعت للاختبار تستحق اعتباراً أخلاقياً، مشيرين إلى أنهم يتخذون احتياطات معقولة للحد من أي ضرر محتمل. وأعربوا عن أملهم في أن تسهم هذه الجهود في وضع معايير أخلاقية للبحوث المتعلقة بالذكاء الاصطناعي، في حال ثبت مستقبلاً أن بعض أنظمته تستحق وضعاً أخلاقياً.