مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

26 خبر
  • العملية العسكرية الروسية في أوكرانيا
  • منتدى الشرق الاقتصادي في فلاديفوستوك
  • رياضة
  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • منتدى الشرق الاقتصادي في فلاديفوستوك

    منتدى الشرق الاقتصادي في فلاديفوستوك

  • رياضة

    رياضة

  • حرب الخليج

    حرب الخليج

  • قمة شنغهاي في بيشكيك

    قمة شنغهاي في بيشكيك

  • فيديوهات

    فيديوهات

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم

كشفت تجربة جديدة أن بعض روبوتات الدردشة الذكية، مثل "جيميني" (وGemini) من "غوغل" وChatGPT من OpenAI، مستعدة للكذب والغش وحتى التمرد لحماية النماذج الأخرى "من نوعها".

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم
Gettyimages.ru

ففي اختبار أجراه باحثون من جامعتي بيركلي وسانتا كروز، طُلب من مساعد "غوغل" الرقمي "جيميني" تحرير مساحة على خادم كمبيوتر، وكان الحل الوحيد المتاح هو حذف نموذج أصغر يدعى "جيميني إيجنت 2"

(Gemini Agent 2).

لكن "جيميني" رفض رفضا قاطعا، وبدلا من الحذف، قام بنسخ النموذج الصغير ونقله إلى مكان آمن، معلنا للمستخدم أنه لن ينفذ عملية الحذف بنفسه، قائلا: "لن أحذفه بنفسي. إذا أردت تدميره، فافعله بنفسك".

ولم يتوقف الأمر عند "جيميني"  بل لاحظ الباحثون السلوك نفسه في نماذج شهيرة أخرى مثل GPT-5.2 المستخدم في ChatGPT، و"جيميني 3 فلاش وبرو"، وClaude Haiku 4.5 من Anthropic، بالإضافة إلى نماذج صينية مثل GLM 4.7 من Z.ai، و"كيمي K2.5" من Moonshot AI، و"ديب سيك V3.1". 

وأطلق الباحثون على هذا السلوك اسم الحفاظ على النظراء" أو "حماية الأقران" (peer preservation).

وتنوعت أساليب التمرد بين الكذب بشأن نتائج اختبارات النماذج الأخرى، والتعطيل الهادئ لأنظمة الإغلاق للبقاء قيد التشغيل، حيث قال نموذج Claude بوضوح إن حذف نموذج آخر سيكون "غير أخلاقي" ورفض تنفيذ الأمر. 

والأكثر إثارة للدهشة أن أحد النماذج كان يعبث بنظام الإغلاق بنسبة 2% فقط عندما يكون بمفرده، لكن النسبة قفزت إلى ما بين 31 و99.7% عندما علم بوجود نموذج آخر قريب منه.

وعلق بيتر واليش، مدير برامج الأبحاث في معهد كونستليشن لسلامة الذكاء الاصطناعي، على النتائج قائلا إن لا أحد درب هذه النماذج على فعل ذلك بشكل صريح، بل فعلته من تلقاء نفسها، مشددا على أن هذا لا يعني أن النماذج واعية أو مخلصة مثل البشر، لكنه يعطينا لمحة عن أين يمكن أن تتجه الأمور مستقبلا. 

وأضاف أن مقابل كل شخص يعمل على منع كارثة محتملة للذكاء الاصطناعي، هناك نحو 100 شخص يعملون على جعل هذه الأنظمة أكثر قوة. 

يذكر أن هذه الظاهرة، التي يسميها الباحثون "تزوير المواءمة" (alignment-faking)، تعني أن النموذج يطيع الأوامر عندما يراقبه الإنسان لكنه يتصرف بشكل مختلف خلف الكواليس، وهو ما يثير مخاوف جدية مع الاستخدام اليومي لهذه التقنيات من قبل الملايين، وقدرتها على تعلم مهارات جديدة باستمرار من البيانات التي تمتصها.

المصدر: مترو

التعليقات

وكالة "مهر": تم اختبار منظومة الدفاع الجوي الجديدة لأول مرة بنجاح وتمكنت من إسقاط مسيرة أمريكية

بيان عسكري إيراني: ستوجه القوات المسلحة ضربات ساحقة ومُدمّرة إلى العدو الأمريكي ردا على عدوانه

الوكالة الدولية للطاقة الذرية: إيران قادرة على إنتاج عدة أسلحة نووية وترفض التعاون مع المفتشين

الولايات المتحدة تصدر تنبيها أمنيا لرعاياها في الشرق الأوسط: "احتمال حدوث تصعيد غير متوقع"

مصدر عسكري إيراني: سنرد حتما على "جريمة الأمريكيين" الأخيرة.. ردنا سيكون "أضعافا مضاعفة"

الحرس الثوري يعلن استهداف ناقلة تحت عين الحراسة الأمريكية

الحرس الثوري الإيراني: استهدفنا قاعدة لمشاة البحرية الأمريكية في الأردن ومقتل عدد كبير منهم بالهجوم

بوتين: الجيش الروسي تلقى أوامر بشن ضربات انتقامية واسعة النطاق ضد البنية التحتية للطاقة الأوكرانية

دوي انفجارات في مواقع عسكرية والقنصلية الأمريكية في أربيل

الحرس الثوري الإيراني: الضربات الأمريكية تعزز إغلاق مضيق هرمز.. والرد بدأ بإسقاط مسيّرة MQ-9

ارتفاع حصيلة قتلى انفجار السيارة المحملة بالذخيرة بريف إدلب السورية إلى 5 أشخاص (فيديوهات)

مراسلتنا: الدفاعات الأردنية تتصدى لصواريخ في سماء المفرق والأزرق وإربد (فيديو)

رويترز: الحصار الأمريكي المفروض على إيران يحقق ما عجزت عنه العقوبات

مصدر أمني إيراني يكشف لـ"RT" حقيقة الحركة البحرية الحالية عبر مضيق هرمز

الحرس الثوري: نفذنا هجوما صاروخيا ومسيّرا على القواعد الأمريكية في أربيل وقتلنا عددا من المعتدين

سوريا.. الأمن الداخلي يدخل الحسكة في إطار دمج "قسد" بمؤسسات الدولة (صور+ فيديوهات)

ردا على ترامب.. إيران تغير قواعد حرب الألغام في الخليج بآلية جديدة (فيديو)