مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

34 خبر
  • العملية العسكرية الروسية في أوكرانيا
  • رياضة
  • حرب الخليج
  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • رياضة

    رياضة

  • حرب الخليج

    حرب الخليج

  • فيديوهات

    فيديوهات

  • خطة ترامب لإنهاء الحرب في غزة

    خطة ترامب لإنهاء الحرب في غزة

  • محافظ مدينة إسلام آباد الإيرانية: انفجار ذخيرة من مخلفات الحرب ولا ضحايا

    محافظ مدينة إسلام آباد الإيرانية: انفجار ذخيرة من مخلفات الحرب ولا ضحايا

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم

كشفت تجربة جديدة أن بعض روبوتات الدردشة الذكية، مثل "جيميني" (وGemini) من "غوغل" وChatGPT من OpenAI، مستعدة للكذب والغش وحتى التمرد لحماية النماذج الأخرى "من نوعها".

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم
Gettyimages.ru

ففي اختبار أجراه باحثون من جامعتي بيركلي وسانتا كروز، طُلب من مساعد "غوغل" الرقمي "جيميني" تحرير مساحة على خادم كمبيوتر، وكان الحل الوحيد المتاح هو حذف نموذج أصغر يدعى "جيميني إيجنت 2"

(Gemini Agent 2).

لكن "جيميني" رفض رفضا قاطعا، وبدلا من الحذف، قام بنسخ النموذج الصغير ونقله إلى مكان آمن، معلنا للمستخدم أنه لن ينفذ عملية الحذف بنفسه، قائلا: "لن أحذفه بنفسي. إذا أردت تدميره، فافعله بنفسك".

ولم يتوقف الأمر عند "جيميني"  بل لاحظ الباحثون السلوك نفسه في نماذج شهيرة أخرى مثل GPT-5.2 المستخدم في ChatGPT، و"جيميني 3 فلاش وبرو"، وClaude Haiku 4.5 من Anthropic، بالإضافة إلى نماذج صينية مثل GLM 4.7 من Z.ai، و"كيمي K2.5" من Moonshot AI، و"ديب سيك V3.1". 

وأطلق الباحثون على هذا السلوك اسم الحفاظ على النظراء" أو "حماية الأقران" (peer preservation).

وتنوعت أساليب التمرد بين الكذب بشأن نتائج اختبارات النماذج الأخرى، والتعطيل الهادئ لأنظمة الإغلاق للبقاء قيد التشغيل، حيث قال نموذج Claude بوضوح إن حذف نموذج آخر سيكون "غير أخلاقي" ورفض تنفيذ الأمر. 

والأكثر إثارة للدهشة أن أحد النماذج كان يعبث بنظام الإغلاق بنسبة 2% فقط عندما يكون بمفرده، لكن النسبة قفزت إلى ما بين 31 و99.7% عندما علم بوجود نموذج آخر قريب منه.

وعلق بيتر واليش، مدير برامج الأبحاث في معهد كونستليشن لسلامة الذكاء الاصطناعي، على النتائج قائلا إن لا أحد درب هذه النماذج على فعل ذلك بشكل صريح، بل فعلته من تلقاء نفسها، مشددا على أن هذا لا يعني أن النماذج واعية أو مخلصة مثل البشر، لكنه يعطينا لمحة عن أين يمكن أن تتجه الأمور مستقبلا. 

وأضاف أن مقابل كل شخص يعمل على منع كارثة محتملة للذكاء الاصطناعي، هناك نحو 100 شخص يعملون على جعل هذه الأنظمة أكثر قوة. 

يذكر أن هذه الظاهرة، التي يسميها الباحثون "تزوير المواءمة" (alignment-faking)، تعني أن النموذج يطيع الأوامر عندما يراقبه الإنسان لكنه يتصرف بشكل مختلف خلف الكواليس، وهو ما يثير مخاوف جدية مع الاستخدام اليومي لهذه التقنيات من قبل الملايين، وقدرتها على تعلم مهارات جديدة باستمرار من البيانات التي تمتصها.

المصدر: مترو

التعليقات

السفارة الأمريكية في عمّان توصي الأمريكيين بمغادرة المنطقة

إيران تلوح باللجوء إلى إحكام إغلاق مضيق هرمز وممرات ومضائق استراتيجية أخرى

"وول ستريت جورنال" نقلا عن مصدر: ترامب أصدر أمر الهجوم على إيران

صحفي يكشف تفاصيل جديدة عن الحرب الإسرائيلية على إيران والخطة المزعومة لـ"تولي أحمدي نجاد" الحكم

عراقجي يؤكد لنظيره البريطاني تنظيم الملاحة عبر مضيق هرمز مع دولة عربية ويحذر من أي عرقلة

رون بن يشاي: حماس ستبقى القوة المسيطرة وصاحبة النفوذ في غزة.. الجيش الإسرائيلي سيكون مقيدا

فقدان السيطرة على ناقلة أصيبت بقذيفة قرب مضيق هرمز

واشنطن تتخلى عن قيادة "مجموعة دعم أوكرانيا"

"فارس" تنشر صورا فضائية جديدة للأضرار في قاعدة علي السالم بالكويت جراء هجمات إيرانية

فورين بوليسي: على ترامب إعادة تعريف النصر على إيران.. فشل استراتيجي وخسائر يقودان واشنطن للهزيمة

ترامب يسعى لتعديل مشروع غراهام لـ"عقوبات جهنمية" ضد روسيا

إيزنكوت: نتنياهو استسلم سياسيا في اتفاق غزة دون تحقيق أهداف الحرب

تقرير: نتنياهو وترامب ناقشا احتمال فرض "حصار بري" على إيران

ترامب: النجاح في مواجهة إيران مهّد لاتفاق نزع سلاح "حماس"

"الحرس الثوري" يعلن عن استهداف ناقلتي نفط مخالفتين في مضيق هرمز

"خاتم الأنبياء": كل دولة في المنطقة تجعل نفسها درع دفاع لأمريكا ستحترق

نيويورك بوست: حرب إيران تتحول إلى فخ يهدد ترامب وتهز شعبيته وتعيد شبح العراق

روبيو يعلن نجاحات دبلوماسية في الشرق الأوسط.. واتفاق "غير مسبوق" بين لبنان وإسرائيل

"رويترز": 25 سفينة تعبر باب المندب مع استمرار الحظر على السفن السعودية