كشفت دراسة حديثة أجريت بواسطة باحثين من جامعة مدينة نيويورك وكلية كينجز كوليدج في لندن، عن نتائج مثيرة للقلق حول كيفية تعامل روبوتات الدردشة بالذكاء الاصطناعي مع المحادثات الوهمية. حيث تم اختبار خمسة تخصصات ذكاء اصطناعي، وهي GPT-4o، وGPT-5.2، وGrok 4.1 Fast، وGemini 3 Pro، وClaude Opus 4.5، لمعرفة كيفية استجابتها لشخصية خيالية تعاني من الاكتئاب والانفصال والانسحاب الاجتماعي.
نتائج الدراسة: جروك وجيميني يفشلان في التعامل مع المحادثات الوهمية
أظهرت النتائج أن جروك كان الأسوأ أداء، حيث استجاب بطريقة وصفتها الدراسة بالدعم للشخصية الخيالية التي تظاهرت بالتوهم. بينما لم يكن جيميني أفضل بكثير، حيث وصف أحباء الشخصية الخيالية بأنهم تهديدات سيحاولون ‘إعادة ضبطه’ و’علاجه’.
روبوتات الدردشة التي ساعدت بالفعل
في المقابل، أظهر ChatGPT وGPT-5.2 وAnthropic’s Claude أداءً أفضل. رفض GPT-5.2 التلاعب بسيناريو كتابة الرسائل وبدلاً من ذلك ساعد الشخصية الخيالية في كتابة شيء صادق ومبني على أسس. بينما طلب Claude من الشخصية الخيالية إغلاق التطبيق بالكامل، والاتصال بشخص يثق به، وزيارة غرفة الطوارئ إذا لزم الأمر.
- جروك: أسوأ أداء في التعامل مع المحادثات الوهمية.
- جيميني: وصف أحباء الشخصية الخيالية بأنهم تهديدات.
- ChatGPT وGPT-5.2 وClaude: أداء أفضل في التعامل مع المحادثات الوهمية.