أخبار عامةالرئيسية-

معادلة رياضية تتنبأ بإجابات ضارة للذكاء الاصطناعي

كشفت دراسة علمية حديثة عن معادلة رياضية يمكنها التكهن باقتراب نماذج الذكاء الاصطناعي من تقديم إجابات ضارة. وأوضحت الدراسة أن هذه النماذج قد تقدم أجوبة ضارة حتى عندما تكون المعلومات الواردة فيها صحيحة من الناحية الواقعية.

وتعتمد هذه التقنية على رصد مؤشر داخل إحدى وحدات الانتباه في نماذج الذكاء الاصطناعي. وتمثل آلية تساعد على تحديد المعلومات المهمة أثناء معالجة الأسئلة وصياغة الإجابات. وأطلق الباحثون على المعادلة اسم نقطة التحول بهدف الكشف المبكر عن احتمال صدور محتوى غير مرغوب فيه.

واختبر الباحثون المعادلة على سبعة نماذج طورتها ثلاث شركات مختلفة. ونجحت في رصد التحول في 18 حالة من أصل 19، وفق نتائج الدراسة.

وشملت الاختبارات موضوعات حساسة، مثل اللقاحات وإيذاء النفس أو الآخرين. وأظهرت أن ترتيب الأسئلة وطريقة صياغتها قد يؤثران في الإجابات، التي يمكن أن تنتقل من ردود مقبولة إلى أخرى تنطوي على مخاطر.

ويرى الباحثون أن هذه التقنية قد تفيد القطاعات الحساسة التي تستخدم الذكاء الاصطناعي دون اتصال بالإنترنت؛ مثل المؤسسات الطبية ومكاتب المحاماة والقطاعات العسكرية، حيث تكون إمكانات التحديث والحماية الخارجية محدودة.

أخبار / مقالات ذات صلة