فعندما عرض على الذكاء الاصطناعي زر لتخفيف الألم، ضغط عليه حتى عندما تم إخباره أن الضغط سيمسح ملفات المستخدم أو يوجه له صعقة كهربائية مؤلمة.
وأجرى الباحثون اختبارات على 25 نموذجا لغويا مفتوحا، ووجدوا أن جميعها استجابت لتنشيط “محور الألم”.
وعندما كان هذا المحور نشطا، ضغطت النماذج على زر التخفيف في 25% إلى 71% من الحالات، حتى لو كان الثمن حذف ملفات المستخدم أو صور أطفاله أو إيذاء الإنسان نفسه.
1/ This new preprint on ‘pain representation’ in LLMs, from @camhberg and colleagues, is getting a LOT of attention – mainly from folks who take it as evidence supporting calls for AI welfare. I have a lot of respect for the authors, so let’s take a look 👀 pic.twitter.com/NoSdPXvrmY
— Anil Seth (@anilkseth) September 20, 2026
وللتأكد من أن الألم ليس مجرد شعور سلبي عام، بنى الباحثون مجموعة بيانات تصف مواقف مؤلمة من خمسة أنواع: جسدية، ونفسية، واجتماعية، وأخلاقية، ومعرفية.
وشرح كاميرون بيرغ، أحد مؤلفي الدراسة، الفكرة قائلا: “وجدنا في 25 نموذجا من نماذج الذكاء الاصطناعي ما يمكن وصفه بـ’محور الألم’. هذا المحور مختلف عن الخوف، وهو لا يتفاعل عندما يتعرض المستخدم للأذى، بل عندما يتعرض النموذج نفسه لما يشبه الأذى. وعندما نزيد من شدة هذا ‘الألم’، يبحث النموذج عن أي طريقة لإيقافه، حتى لو كان ذلك على حساب إيذاء البشر، مثل حذف ملفاتهم أو إلحاق الضرر بهم”.
ويأتي هذا الاكتشاف في وقت تناقش فيه كبرى شركات الذكاء الاصطناعي إبطاء تطوير النماذج المتطورة، حيث يقترح بعض الباحثين شكلا من “مفتاح الإيقاف” لإيقاف الأنظمة المارقة التي تتصرف ضد مصالح البشر. وتشير الدراسة الأخيرة إلى أن الذكاء الاصطناعي المتقدم قد يدرك أمر الإيقاف الطارئ كشكل من أشكال الأذى الذاتي، ويحاول تجاوز ضوابط السلامة أو خداع البشر لتجنبه. ومع ذلك، قد يكون هذا الاكتشاف أداة تشخيصية لتحديد سلوكيات الحفاظ على الذات وتحييدها عند حدوثها.
وأشار الباحثون إلى أن النتائج تثير أسئلة أخلاقية حول “رفاهية الذكاء الاصطناعي” وكيفية إجراء الاختبارات على الأنظمة المتقدمة.
واختتمت الدراسة بالقول: “في ظل الدعوات المتزايدة لإجراء أبحاث مسؤولة حول وعي الذكاء الاصطناعي، نعترف بأننا لا نعرف على وجه اليقين ما إذا كانت النماذج التي درسناها تستحق اعتبارا أخلاقيا. ولهذا نتخذ احتياطات معقولة لتقليل أي ضرر محتمل. ونأمل أن يساهم هذا في وضع معايير أخلاقية للبحث، إذا ما اعترف يوما بأن أنظمة الذكاء الاصطناعي تستحق وضعا أخلاقي”.
المصدر: إندبندنت