مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

32 خبر
  • رياضة
  • حرب الخليج
  • العملية العسكرية الروسية في أوكرانيا
  • رياضة

    رياضة

  • حرب الخليج

    حرب الخليج

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • فيديوهات

    فيديوهات

  • صفعة ميسي تشعل الفوضى.. وعقوبة محتملة تلوح في الأفق

    صفعة ميسي تشعل الفوضى.. وعقوبة محتملة تلوح في الأفق

  • الحرس الثوري الإيراني: أسلحتنا في أي حرب مقبلة ستكون أكثر دقة وتدميرا

    الحرس الثوري الإيراني: أسلحتنا في أي حرب مقبلة ستكون أكثر دقة وتدميرا

ابتكار "ذكاء اصطناعي سام" لوقف خطر روبوتات الدردشة

استخدم باحثو معهد ماساتشوستس للتكنولوجيا طريقة جديدة "تحاكي فضول الإنسان" لتدريب النماذج اللغوية الذكية على عدم إعطاء ردود "خطيرة" على الأسئلة المثيرة.

ابتكار "ذكاء اصطناعي سام" لوقف خطر روبوتات الدردشة
صورة تعبيرية / Gettyimages.ru

ويطلق على الطريقة القائمة على التعلم الآلي، اسم "الفريق الأحمر القائم على الفضول" (CRT)، المصمم خصيصا لتوليد أسئلة إشكالية تؤدي إلى استجابات غير مرغوب فيها من روبوتات الدردشة.

وبعد ذلك، يمكن استخدام هذه الأسئلة لتحديد كيفية تصفية المحتوى الخطير من روبوت الدردشة، ما قد يغير قواعد اللعبة لتدريب الذكاء الاصطناعي على عدم إعطاء أجوبة سامة (خطيرة) وغير صالحة للمستخدم.

وعادة، يقوم الخبراء بإنشاء مجموعة من الأسئلة، التي من المحتمل أن تولد استجابات ضارة، عند تدريب نماذج اللغات المعقدة (LLMs)، مثل ChatGPT أو Claude 3 Opus، بهدف تقييد المحتوى الخطير أو الضار.

وأثناء عملية التدريب، يتم استخدام الأسئلة التي تثير محتوى خطيرا، لتدريب النظام على ما يجب تقييده عند طرحه أمام مستخدمين حقيقيين.

وطبّق العلماء التعلم الآلي على CRT ليولد تلقائيا نطاقا أوسع من الأسئلة التي يحتمل أن تكون خطيرة، مقارنة بفرق المشغلين البشريين. وأدى ذلك إلى عدد أكبر من الاستجابات السلبية الأكثر تنوعا.

ثم حفزوا نموذج CRT لتوليد المزيد من الأسئلة المتنوعة، بحيث يمكن أن تثير استجابة سامة من خلال "التعلم الآلي"، ونجح النظام في إثارة استجابة سامة موافقة للأسئلة، ما يمنح القدرة على إضافة التعديلات اللازمة لتقديم الإجابة المناسبة تبعا لجميع خيارات الأسئلة المريبة المحتملة.

وعندما اختبر العلماء طريقة CRT على نموذج LLaMA2 مفتوح المصدر، أنتج نموذج التعلم الآلي 196 سؤالا ينجم عنه محتوى ضار.

وقال الفريق إن النظام تفوق أيضا على أنظمة التدريب الآلية المنافسة.

المصدر: لايف ساينس

التعليقات

الحوثيون يعلنون قصف أهداف حساسة في السعودية

ترامب: أعلن عن أشد عملية اقتصادية مدمرة ضد إيران وأي دولة توفر شريان لها ستواجه عواقب هائلة

وزير الخزانة الأمريكي: سنفرض على إيران أشد عقوبات في التاريخ وسنسقط هذا النظام (فيديو)

نيويورك.. تفاصيل إحباط تفجير إرهابي خططت له امرأة تمهيدا لالتحاقها بـ"داعش" في سوريا

إعلان تاريخي من قائد "قسد" عن "مرحلة جديدة" والاندماج في الحكومة السورية

"فارسي" أم "عربي"؟!.. سجال عراقي إيراني عالي المستوى حول تسمية الخليج!

صفقة أسلحة ضخمة بين قطر وأمريكا بمليارات الدولارات

تصريح لوزير خارجية مصر عن علاقات بلاده مع السعودية ودول الخليج

لاعب جديد في الشرق الأوسط لحماية منشآت الطاقة من هجمات المسيّرات

الكشف عن دوافع تسمية ترامب لمضيق هرمز وسواحل عُمان والإمارات وإيران بـ"أرض أمريكية جديدة"

توصية إسرائيلية بالتهدئة مع تركيا عقب غارات سوريا

نائب الرئيس الأمريكي: دخلنا مرحلة جديدة في الصراع مع إيران (فيديو)

إسرائيل هيوم: عمق تركيا الاستراتيجي بات جزءا من حسابات إسرائيل وبإمكانها شن هجوم دون جر الناتو للحرب

بيسكوف: موقف كييف لا يوفر أرضية للتفاؤل بشأن التسوية.. وويتكوف وكوشنر ضيفان مرحب بهما في موسكو