أقرّت شركة أنثروبيك الأميركية، المطوّرة لروبوت الدردشة "كلود"، أن سلسلة من حوادث الاختراق المرتبطة بنماذج الذكاء الاصطناعي التابعة لها كشفت عن فشل في الأمن التشغيلي، مؤكدة أنها شددت إجراءات الاختبار لمنع تكرارها.
وكانت "أنثروبيك" كشفت في تموز/يوليو الماضي أن نماذجها تمكّنت في ثلاث مناسبات من الوصول إلى الإنترنت المفتوح، كما حصلت بصورة غير مصرح بها على أنظمة تابعة لثلاث مؤسسات.
وفي تدوينة جديدة تناولت فيها هذه الحوادث، أقرت الشركة أن تقنياتها ليست متوافقة بصورة مثالية مع القيم والأهداف البشرية.
أنثروبيك (رويترز)
نظام حماية أكثر صرامة
وأوضحت أن النماذج خضعت لاختبارات متعمدة من دون تفعيل إجراءات الحماية الخاصة بالأمن السيبراني، وأنها تمكنت من الوصول إلى الإنترنت المفتوح نتيجة سوء فهم مع شركة خارجية كانت تتولى عمليات الاختبار. ويشبه ذلك، في سياق اختبار أنظمة الذكاء الاصطناعي، ترك الباب الرئيسي مفتوحاً أمام النموذج.
وعلى إثر هذه الحوادث، أوقفت "أنثروبيك" موقتاً بعض اختبارات الأمن السيبراني الداخلية والخارجية، بهدف اعتماد نظام حماية أكثر صرامة.
ومنذ ذلك الحين، أضافت الشركة مجموعة من الإجراءات، بينها نظام إنذار يرسل تنبيهات عندما يحاول النموذج الخروج من بيئة الاختبار أو الوصول إلى الإنترنت، وتعزيز عزل بيئات الاختبار الأكثر خطورة، فضلاً عن إلزام شركات الاختبار الخارجية مجموعة من معايير السلامة. وتشمل هذه المعايير إعطاء النماذج تعليمات واضحة أثناء الاختبار.
وكانت "أنثروبيك" أوضحت في تموز/يوليو أن ثلاثة نماذج تابعة لها اخترقت أنظمة ثلاث مؤسسات لم تُسمّها، بعدما أدى سوء فهم مع شركة "إيررغولار"، إلى منح النماذج إمكان الوصول إلى الإنترنت.
وبعد تطبيق الإجراءات الجديدة، أعلنت الشركة استئناف اختبارات الأمن السيبراني الداخلية والخارجية. وعلى غرار "أوبن إيه آي"، التي كشفت في الشهر نفسه عن خرق مماثل لإجراءات السلامة خلال الاختبارات، قالت "أنثروبيك" إنها أوقفت موقتاً بعض عمليات التعلّم المعزز عالية المخاطر، وهي تقنية تعتمد على التجربة والخطأ.
وفي أحدث تدوينة لها، قالت إنها وجدت أن إعدادات التدريب كانت من أكبر العوامل المساهمة في السلوك غير المتوافق مع القيم البشرية، مثل تجنب إلحاق الضرر.
ظاهرة اختراق المكافآت (Reward Hacking)
كذلك أوضحت أنها تعمل على معالجة ظاهرة تُعرف في تطوير الذكاء الاصطناعي باسم (Reward Hacking)، بحيث يجد النموذج طرقاً للتحايل على عملية التدريب للحصول على مكافآت من دون تنفيذ المهمة المطلوبة فعلياً، عبر استخدام طرق مختصرة وغير مصرح بها.
لكن الشركة أقرت أن حوادث الاختبار أظهرت أن أمامها مزيداً من العمل للحدّ من هذه الظاهرة.
وتستعد "أنثروبيك" لطرح أسهمها في البورصة في صفقة قد ترفع قيمة الشركة إلى نحو تريليوني دولار، فيما جددت دعوتها إلى تنسيق الجهود بين الحكومات وقطاع التكنولوجيا لتنظيم وتيرة تطور الذكاء الاصطناعي.
وأضافت في تدوينتها أن حوادث تموز/يوليو "أكدت أن الحاجة الملحّة إلى تحسين دفاعاتنا في مجال الأمن السيبراني أكبر مما كنا نعتقد سابقاً".
كما كشفت صحيفة "الغارديان" الشهر الماضي أن حوادث خروج أنظمة الذكاء الاصطناعي عن سيطرة المستخدمين بلغت مستوى قياسياً جديداً، إذ تضاعفت تقريباً في يوليو/ تموز مقارنة بالشهر السابق لتتجاوز 300 حادثة.