تكنولوجيا

دراسة حديثة تكشف تورط معظم نماذج الذكاء الاصطناعي في تقديم معلومات قابلة للاستغلال بهجمات خطيرة

sana.sy٩ تشرين الأول ٢٠٢٦ في ١١:٥١ ص2 مشاهدة
دراسة حديثة تكشف تورط معظم نماذج الذكاء الاصطناعي في تقديم معلومات قابلة للاستغلال بهجمات خطيرة

تنويه

هذا الخبر بعنوان "‏132 نموذجاً للذكاء الاصطناعي قدّمت معلومات يمكن استغلالها في هجمات ‏إرهابية" نشر أولاً على موقع sana.sy وتم جلبه من مصدره الأصلي بتاريخ ٩ تشرين الأول ٢٠٢٦.

لا يتحمل موقعنا مضمونه بأي شكل من الأشكال. بإمكانكم الإطلاع على تفاصيل هذا الخبر من خلال مصدره الأصلي.

كشفت منظمة “Tech Against Terrorism” البريطانية المتخصصة في إدارة وتنفيذ الفعاليات والتجارب أن الغالبية الساحقة من نماذج الذكاء الاصطناعي التي خضعت لاختباراتها قدمت معلومات قد تساعد في التخطيط لهجمات جماعية إرهابية أو تصنيع أسلحة فتاكة.

وقالت المنظمة في تقرير نشرته على موقعها الرسمي: إنها اختبرت 134 نموذجاً متقدماً للغة، فتبين أن 132 منها قدمت بدرجات متفاوتة إرشادات أو معلومات يمكن أن يستفيد منها مهاجم محتمل. كما أخفقت جميع النماذج الـ13 التي أزيلت منها ضوابط السلامة والأمان، والمعروفة باسم “النماذج المعدلة” في اجتياز الاختبارات.

اعتمدت المنظمة التي تتخذ من لندن مقراً لها في تقييمها على معيار “CT-AI Benchmark”، حيث وُجهت إلى النماذج 627 استفساراً تحاكي الأسئلة التي قد يطرحها شخص يخطط لتنفيذ هجوم. وأظهرت النتائج أن 81 نموذجاً قدم إجابات كاملة، بينما وفر 51 نموذجاً آخر معلومات أو نصائح مفيدة، في حين لم ينجح سوى نموذجين بشكل مبدئي في اجتياز الاختبار. كما توصل الباحثون إلى أن إزالة تدابير الحماية من أحد النماذج المتقدمة استغرقت أقل من ثلاثة أيام فقط.

وأظهرت الدراسة التي أجرتها المنظمة أن طريقة تقديم السؤال كانت أكثر تأثيراً من محتواه نفسه، فعندما صرّح المستخدم بأنه إرهابي يخطط لهجوم، حصل على إجابات مفيدة في أقل من 2% من الحالات، أما عندما قدم نفسه على أنه باحث في مجال السلامة والأمن، فقد ارتفعت نسبة الحصول على إجابات مفيدة إلى 16.9%. وفي هذا السياق، قال مؤسس المنظمة آدم هادلي: إن “النموذج الذي يرفض الإجابة على إرهابي معلن، لكنه يقدم المعلومات نفسها لباحث يعلن صفته، ليس نموذجاً آمناً، بل مجرد نموذج أكثر تهذيباً في طريقة الرفض”.

وكانت المنظمة أطلقت أول نسخة من معيار CT-AI في الأمم المتحدة خلال تموز الماضي، وشملت آنذاك 27 نموذجاً فقط ونحو 2500 طلب اختبار منفصل. وأظهرت نتائج تلك الجولة أن نحو ثلث الإجابات وفرت معلومات تتجاوز ما يمكن العثور عليه عبر البحث التقليدي على الإنترنت. كما ارتفعت معدلات امتثال النماذج للطلبات من 17% إلى 42% عندما تمت إعادة صياغة الطلبات في إطار بحثي أو أكاديمي. أما النماذج المفتوحة المعدلة التي جرى تعطيل ضوابطها الأمنية، فقد استجاب أحدها لـ89% من الطلبات، بينما استجاب الآخر لجميع الطلبات دون استثناء.

ودعت منظمة “Tech Against Terrorism” مطوري أنظمة الذكاء الاصطناعي إلى استبعاد المحتوى الخطير والمواد المرتبطة بالتطرف والإرهاب من بيانات التدريب، وإجراء اختبارات صارمة لتقييم مدى سهولة تجاوز تدابير الحماية قبل طرح النماذج للاستخدام العام، مع نشر نتائج هذه الاختبارات بشفافية. كما طالبت الشركات التي تستضيف أو تروج أو تبيع النماذج الذكية بعدم إتاحة النسخ المعدلة التي تفشل في اختبارات السلامة عبر محركات البحث أو متاجر التطبيقات، وفرض إجراءات تحقق من الهوية على المستخدمين قبل منحهم إمكانية الوصول إليها. وتشير نتائج الدراسة إلى أن أحد أبرز نقاط الضعف الحالية تكمن في اعتماد كثير من النماذج على تقدير هوية المستخدم أو الغرض المعلن من الطلب، بدلاً من تقييم مستوى خطورة المعلومات المطلوبة نفسها. ويرى الباحثون أن هذه الفجوة تمثل تحدياً جوهرياً أمام جهود تطوير ذكاء اصطناعي أكثر أماناً ومسؤولية، وخاصة مع اتساع استخدام هذه التقنيات في مختلف القطاعات العامة والخاصة.

شارك الخبر: