كشفت دراسة حديثة عن معادلة رياضية بسيطة يمكنها التنبؤ باللحظة التي ينتقل فيها الذكاء الاصطناعي من تقديم إجابات نافعة إلى إجابات قد تكون ضارة رغم صحة مضمونها.
كيف تعمل المعادلة؟
رصد الباحثون مؤشرا داخل إحدى وحدات “الانتباه” في نماذج الذكاء الاصطناعي، وهي آلية تساعدها على تحديد المعلومات المهمة عند صياغة الإجابات. وبناء على ذلك، طوروا ما أسموه “معادلة نقطة التحول”، بهدف التنبؤ باقتراب النظام من تقديم إجابة غير مرغوب فيها.
ولا يعني هذا التحول بالضرورة أن تصبح الإجابة خاطئة، بل قد تكون صحيحة واقعيا لكنها ضارة، مثل تقديم معلومات قد تشجع على إيذاء النفس أو تقود إلى قرارات خطيرة.
نجاح في 18 حالة من أصل 19
اختبر الباحثون المعادلة على سبعة نماذج للذكاء الاصطناعي طورتها ثلاث شركات مختلفة، ونجحت في رصد التحول في 18 حالة من أصل 19.
وشملت الاختبارات أسئلة عن اللقاحات وإيذاء النفس أو الآخرين، وأظهرت أن ترتيب الأسئلة وطريقة صياغتها قد يؤثران في إجابات النظام، الذي قد يبدأ بردود مقبولة قبل أن ينتقل إلى أخرى ضارة مع استمرار الحوار.
من المستفيد من هذا الاكتشاف؟
قد تكون التقنية مفيدة خصوصا في القطاعات الحساسة التي تستخدم الذكاء الاصطناعي دون اتصال بالإنترنت، حيث تكون إمكانات التحديث والحماية الخارجية محدودة.
وتشمل أبرز الفئات التي قد تستفيد منها:
-
الأطباء: لحماية بيانات المرضى التي لا يمكن إرسالها إلى الخدمات السحابية.
-
المحامون: عند التعامل مع المعلومات والملفات السرية.
-
العسكريون: في المناطق التي تفتقر إلى التغطية الشبكية.
وقال نيل إف. جونسون، أحد معدّي الدراسة، إن هذه البيئات قد تكون أكثر عرضة لمخاطر الإجابات غير المرغوب فيها بسبب محدودية وسائل الحماية والتحديث.
نحو أنظمة ذكاء اصطناعي أكثر أمانا
يأمل الباحثون أن يتيح هذا الاكتشاف تطوير أدوات إنذار مبكر تنبّه المستخدمين أو المطورين إلى احتمال صدور إجابات ضارة قبل ظهورها فعليا، وأن يساعد في فهم أسباب تحول أنظمة الذكاء الاصطناعي من تقديم إجابات مفيدة إلى أخرى ضارة.
نشرت الدراسة في مجلة “Patterns”.
المصدر: إندبندنت
إقرأ المزيد
الذكاء الاصطناعي يتحدى علماء الرياضيات.. ونتائج OpenAI تثير الجدل
تواصل شركات الذكاء الاصطناعي توسيع حضورها في المجالات العلمية، وفي مقدمتها الرياضيات، لكن هذا التوسع يثير في الوقت نفسه جدلا حول مدى دقة النتائج التي تنتجها النماذج الجديدة.
هل يمكن أن يصبح الذكاء الاصطناعي واعيا يوما ما؟
يتسارع تطور الذكاء الاصطناعي، وتزداد معه قدرة روبوتات المحادثة على خوض حوارات تكاد تحاكي تلك التي يجريها الإنسان.