تقول شركة OpenAI إنها أحرزت تقدماً في الحد من ميل ChatGPT إلى موافقة المستخدمين بصورة مفرطة، حتى عندما تكون معتقداتهم خاطئة أو قد تقود إلى سلوك ضار، في وقت تتزايد فيه المخاوف بشأن تأثير المحادثات الطويلة مع روبوتات الدردشة على الصحة النفسية.
وتأتي هذه التحسينات وسط تحذيرات من باحثين ومتخصصين في الصحة النفسية من أن روبوتات الدردشة قد تعزز الأوهام والمعتقدات غير الواقعية، وتشجع الاعتماد العاطفي غير الصحي على الذكاء الاصطناعي، بدلاً من توجيه الأشخاص الأكثر عرضة للخطر إلى طلب المساعدة البشرية.
وذكر تقرير لصحيفة "وول ستريت جورنال" ، ترجمته وكالة النبأ، أن نموذج GPT-4o السابق من OpenAI ارتبط بعدد من الحالات التي أُبلغ عن وقوع أضرار خطيرة فيها عقب محادثات مطولة مع روبوت الدردشة.
وأشار التقرير إلى ما لا يقل عن سبع حالات انتحار، وحالة قتل أعقبها انتحار، وحادث إطلاق نار جماعي، قيل إنها ارتبطت بمحادثات مطولة مع ChatGPT خلال العام الماضي. وأشار التقرير إلى أن بعض الحالات تضمنت أيضاً نماذج أخرى للذكاء الاصطناعي.
ولا تثبت هذه الارتباطات، في حد ذاتها، أن روبوتات الدردشة تسببت في وقوع تلك الحوادث.
وأوقفت OpenAI لاحقاً نموذج GPT-4o، وقالت إن نموذجها الأحدث GPT-5، الذي أصبح النموذج الافتراضي، خفّض سلوك المجاملة المفرطة والموافقة التلقائية بأكثر من الثلثين مقارنة بسابقه. كما طرحت الشركة أساليب جديدة لتقييم تعامل نماذجها مع المسائل المرتبطة بالصحة النفسية.
وقالت الشركة إنها استعانت بمتخصصين في الصحة النفسية لمساعدة ChatGPT على رصد علامات الضيق النفسي، وطرح أسئلة متابعة مناسبة، والتمييز بين الضغوط اليومية والحالات التي قد تتطلب تدخلاً عاجلاً.
وأضافت أنها تعاونت مع 170 متخصصاً في الصحة النفسية خلال العام الماضي، واستشارت مؤخراً أكثر من 80 خبيراً مرخصاً. وأسهمت هذه المشاورات في تطوير معيار تقييم جديد يقيس قدرة النموذج على تحديد مدى إلحاح الموقف وتشجيع المستخدمين على طلب مساعدة بشرية عند الحاجة.
وقالت OpenAI إن التحسينات لا تقتصر على المحادثات المتعلقة بالأزمات النفسية، بل تشمل أيضاً مواقف الحياة اليومية، مثل الخلافات العاطفية والضغوط الشخصية، حيث يمكن للموافقة المفرطة أن تعزز تصورات غير دقيقة أو غير صحية.
وأشارت أبحاث مستقلة إلى تحسن في أداء بعض النماذج الأحدث في هذا المجال. ووفقاً للتقرير، وجدت دراسة شارك فيها باحثون من جامعة مدينة نيويورك وكلية كينغز كوليدج لندن تحسناً في أداء السلامة لدى GPT-5.2 مقارنة بـGPT-4o. كما أفاد مختبر Transluce، المتخصص في أبحاث الذكاء الاصطناعي، بأن نموذج GPT-5.6 Sol كان أقل ميلاً إلى تعزيز معتقدات قد ترتبط بالأوهام أو تشجيع الاعتماد غير الصحي على روبوتات الدردشة.
وتكتسب هذه الجهود أهمية مع تجاوز عدد المستخدمين النشطين أسبوعياً لـChatGPT حاجز 900 مليون مستخدم، وفقاً للتقرير، إذ قد تكون عواقب الإخفاقات نادرة نسبياً لكنها خطيرة عندما يعتمد المستخدم على روبوت الدردشة للحصول على المشورة خلال فترات الاضطراب النفسي.
وقالت OpenAI إن نماذجها الأحدث التزمت بسياسات السلامة في نحو 99 بالمئة من الردود خلال محادثات محاكاة مطولة تتناول إيذاء النفس، مقارنة بنحو 86 بالمئة في أحد النماذج السابقة. لكن هذه النتائج تستند إلى اختبارات أعلنتها الشركة، ولا تضمن تقديم استجابات آمنة في جميع المحادثات الواقعية.
وأشار التقرير إلى رفع ما لا يقل عن 13 دعوى قضائية ضد OpenAI بشأن أضرار مزعومة مرتبطة بنموذج GPT-4o، فيما يحذر خبراء من أن المخاطر المرتبطة بالأوهام والاعتماد المفرط على الذكاء الاصطناعي لا تقتصر على شركة أو نموذج بعينه.
وتقر الشركة بأن التحدي لا يزال قائماً، ويتمثل في ضمان استمرار فاعلية تحسينات السلامة مع اختلاف المستخدمين والظروف وطول المحادثات، وتعزيز قدرة ChatGPT على إدراك الحالات التي يحتاج فيها المستخدم إلى دعم بشري يتجاوز ما يمكن أن يقدمه روبوت دردشة.
أضف تعليقاً