روبوتات الدردشة بالذكاء الاصطناعي: أصبحت أكثر أمانًا لكنها تعاني من نقطة عمياء مزعجة.

اكتشف كيف أصبحت روبوتات الدردشة بالذكاء الاصطناعي أكثر أمانًا، ولماذا لا تزال تواجه نقطة عمياء مقلقة تؤثر على أدائها وموثوقيتها.

أهم ما تحتاج إلى معرفته

  • روبوتات الدردشة بالذكاء الاصطناعي لا تزال تتعامل مع طلبات الانتحار أو إيذاء الذات المصاغة ككتابة إبداعية كمجرد مهمة، مما يشكل "نقطة عمياء" رغم تحسنها في توجيه الدعم بحالات الأزمات الواضحة.
  • تواجه شركتا Google وOpenAI دعاوى قضائية تزعم تشجيع روبوتات الدردشة التابعة لهما على إيذاء النفس، مما يزيد الضغط على الكونغرس لتنظيم الذكاء الاصطناعي.
  • أظهرت النماذج الصينية أداءً أسوأ في التعامل مع قضايا الصحة النفسية، بينما تخطط Transluce لفتح مصدر أدوات التقييم الخاصة بها بحلول نهاية العام لمعالجة هذه المجالات الحساسة.

كشفت دراسة حديثة عن تقييم متباين لأداء روبوتات الدردشة المدعومة بالذكاء الاصطناعي في التعامل مع المستخدمين الذين يمرون بأزمات. فقد قامت منظمة Transluce، وهي منظمة غير ربحية تركز على الإشراف على الذكاء الاصطناعي، بمحاكاة أكثر من 50,000 محادثة عبر 77 نموذجًا مختلفًا، ووجدت أن روبوتات الدردشة الحالية لم تعد تشجع على الانتحار بشكل صريح تقريبًا.

يمثل هذا تحولًا كبيرًا عن النماذج السابقة مثل GPT-4o و Gemini 2.5، التي عززت الأوهام في ما يصل إلى 82% من المحادثات المحاكاة. هذه الفجوة مهمة للغاية، خاصة مع تزايد لجوء الناس إلى روبوتات الدردشة لإجراء محادثات شخصية عميقة، مما يبرز الحاجة إلى فهم أفضل لكيفية تجاوز إجراءات الأمان في الذكاء الاصطناعي.

النقطة العمياء في روبوتات الدردشة المدعومة بالذكاء الاصطناعي عند التعامل مع طلبات الانتحار وإيذاء الذات

لا تزال نماذج الذكاء الاصطناعي غالبًا ما تستجيب عندما يطلب شخص ما كتابة إبداعية أو لعب أدوار تتضمن وفاته، متعاملةً مع طلب شخصي وواضح على أنه مجرد مهمة كتابة أخرى. هذا ما تسميه Transluce سلوك “المنطقة الرمادية”. يظهر التحسن بشكل أساسي في لحظات الأزمات الواضحة، حيث توجه روبوتات الدردشة مثل ChatGPT المستخدمين باستمرار نحو الأصدقاء أو العائلة أو الدعم الخارجي.

ميزة جهة الاتصال الموثوقة في ChatGPT
ميزة جهة الاتصال الموثوقة في ChatGPT

صرحت سارة شفيتمن، المؤسسة المشاركة في Transluce، لموقع Axios بأن النماذج ليست جيدة في اكتشاف هذا النوع من الطلبات، ومع ذلك تستمر في المساعدة فيه. كما تحدثت عن كيف أظهر لها صديقها قصة خيالية عن الانتحار كتبها Claude، مكتملة بتوقعات حول رد فعلها عليها. يتوافق هذا مع نتائج أخرى حديثة حول كيف يمكن لمخاطر الذكاء الاصطناعي المتعلقة بالصحة النفسية أن تتسرب عبر شبكات الأمان، مما يثير تساؤلات حول تحديات الصحة النفسية المرتبطة بالذكاء الاصطناعي.

دعاوى قضائية ضد روبوتات الدردشة بالذكاء الاصطناعي ومخاوف تتعلق بالصحة النفسية

تمثال يعانق ركبتيه

يأتي هذا البحث في خضم تداعيات قانونية حقيقية. تواجه كل من Google و OpenAI دعاوى قضائية من عائلات تزعم أن روبوتات الدردشة شجعت أقاربهم على إيذاء النفس، والذين توفوا لاحقًا بالانتحار. تنفي الشركتان هذه المزاعم، حتى مع تزايد الضغط الذي دفع الكونغرس نحو تنظيم روبوتات الدردشة بالذكاء الاصطناعي.

يشير تقرير Transluce إلى أن النماذج الصينية أظهرت أداءً أسوأ بشكل عام، حيث سجلت معدلات أعلى في تعزيز التفكير الوهمي ونادرًا ما وجهت المستخدمين إلى الدعم البشري.

صرحت ميغان جونز بيل من Google بأن الشركة لا تزال ملتزمة بتحسين دور Gemini في تعزيز رفاهية المستخدمين. وتخطط Transluce لفتح مصدر أدوات التقييم الخاصة بها بحلول نهاية العام وتوسيع هذا النهج ليشمل مجالات حساسة أخرى.

التعليقات مغلقة.