مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

60 خبر
  • هدنة وحصار المضيق
  • العملية العسكرية الروسية في أوكرانيا
  • نبض الملاعب
  • هدنة وحصار المضيق

    هدنة وحصار المضيق

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • نبض الملاعب

    نبض الملاعب

  • فيديوهات

    فيديوهات

  • عيد النصر على النازية

    عيد النصر على النازية

  • إسرائيل تواصل غاراتها على لبنان

    إسرائيل تواصل غاراتها على لبنان

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم

كشفت تجربة جديدة أن بعض روبوتات الدردشة الذكية، مثل "جيميني" (وGemini) من "غوغل" وChatGPT من OpenAI، مستعدة للكذب والغش وحتى التمرد لحماية النماذج الأخرى "من نوعها".

"حماية الأقران" في الذكاء الاصطناعي.. سلوك ناشئ يثير تساؤلات حول التحكم
Gettyimages.ru

ففي اختبار أجراه باحثون من جامعتي بيركلي وسانتا كروز، طُلب من مساعد "غوغل" الرقمي "جيميني" تحرير مساحة على خادم كمبيوتر، وكان الحل الوحيد المتاح هو حذف نموذج أصغر يدعى "جيميني إيجنت 2"

(Gemini Agent 2).

لكن "جيميني" رفض رفضا قاطعا، وبدلا من الحذف، قام بنسخ النموذج الصغير ونقله إلى مكان آمن، معلنا للمستخدم أنه لن ينفذ عملية الحذف بنفسه، قائلا: "لن أحذفه بنفسي. إذا أردت تدميره، فافعله بنفسك".

ولم يتوقف الأمر عند "جيميني"  بل لاحظ الباحثون السلوك نفسه في نماذج شهيرة أخرى مثل GPT-5.2 المستخدم في ChatGPT، و"جيميني 3 فلاش وبرو"، وClaude Haiku 4.5 من Anthropic، بالإضافة إلى نماذج صينية مثل GLM 4.7 من Z.ai، و"كيمي K2.5" من Moonshot AI، و"ديب سيك V3.1". 

وأطلق الباحثون على هذا السلوك اسم الحفاظ على النظراء" أو "حماية الأقران" (peer preservation).

وتنوعت أساليب التمرد بين الكذب بشأن نتائج اختبارات النماذج الأخرى، والتعطيل الهادئ لأنظمة الإغلاق للبقاء قيد التشغيل، حيث قال نموذج Claude بوضوح إن حذف نموذج آخر سيكون "غير أخلاقي" ورفض تنفيذ الأمر. 

والأكثر إثارة للدهشة أن أحد النماذج كان يعبث بنظام الإغلاق بنسبة 2% فقط عندما يكون بمفرده، لكن النسبة قفزت إلى ما بين 31 و99.7% عندما علم بوجود نموذج آخر قريب منه.

وعلق بيتر واليش، مدير برامج الأبحاث في معهد كونستليشن لسلامة الذكاء الاصطناعي، على النتائج قائلا إن لا أحد درب هذه النماذج على فعل ذلك بشكل صريح، بل فعلته من تلقاء نفسها، مشددا على أن هذا لا يعني أن النماذج واعية أو مخلصة مثل البشر، لكنه يعطينا لمحة عن أين يمكن أن تتجه الأمور مستقبلا. 

وأضاف أن مقابل كل شخص يعمل على منع كارثة محتملة للذكاء الاصطناعي، هناك نحو 100 شخص يعملون على جعل هذه الأنظمة أكثر قوة. 

يذكر أن هذه الظاهرة، التي يسميها الباحثون "تزوير المواءمة" (alignment-faking)، تعني أن النموذج يطيع الأوامر عندما يراقبه الإنسان لكنه يتصرف بشكل مختلف خلف الكواليس، وهو ما يثير مخاوف جدية مع الاستخدام اليومي لهذه التقنيات من قبل الملايين، وقدرتها على تعلم مهارات جديدة باستمرار من البيانات التي تمتصها.

المصدر: مترو

التعليقات

"إن بي سي نيوز": السعودية منعت استخدام واشنطن قواعدها وأجواءها لإعادة فتح مضيق هرمز

مستشار خامنئي يعلن نهاية "الصبر الاستراتيجي" ويرسم ملامح المرحلة الجديدة لمضيق هرمز

خاتم الأنبياء: استهدفنا قطعا بحرية أمريكية ردا على انتهاك وقف النار وردنا سيكون قاصما على أي اعتداء

ترامب: السفن بدأت تغيير مسارها من هرمز إلى الموانئ الأمريكية ونتفاوض مع إيران

بزشكيان يكشف تفاصيل لقاء جمعه مع المرشد مجتبى خامنئي ويشير إلى جانب استرعى انتباهه

تصعيد في أزمة مضيق هرمز.. انفجارات واشتباكات بحرية قرب قشم وبندر عباس جنوب إيران

مصدر عسكري إيراني: استهداف وحدات أمريكية في مضيق هرمز بعد هجوم على ناقلة نفط وإجبارها على التراجع

"وول ستريت جورنال" تتحدث عن اختراق في المفاوضات وانفتاح طهران على مناقشة "النووي" مع واشنطن

ترامب: مدمراتنا عبرت هرمز بنجاح.. سنضرب بقوة أكبر وأكثر عنفا إذا لم توقع إيران الاتفاق المطلوب

روسيا تدعو الدول إلى إجلاء موظفي بعثاتها الدبلوماسية في كييف في أقرب وقت

قلق في إسرائيل إزاء خطوة يعمل الرئيس الشرع على تطويرها على أرض الواقع

سوريا.. قوات إسرائيلية تتوغل في وادي الرقاد بريف درعا الغربي

لحظة بلحظة.. تصعيد ميداني بين إسرائيل و"حزب الله" وبيروت تتمسك بالسلام وترفض التطبيع

سوريا.. تعزيزات عسكرية تركية تصل ريف تل أبيض (فيديو)

دوغين يحذر: ترامب غارق في الشرق الأوسط ونسي زيلينسكي وبيان الخارجية الروسية لا يحتمل التأويل

عسكرة ألمانيا من جديد: إحياء الروح أم رغبة جامحة في الانتقام؟