أنثروبيك تعترف بإخفاقات أمنية بعد حوادث اختراق نفذتها نماذج الذكاء الاصطناعي Claude
أقرت شركة Anthropic الأمريكية، المطورة لروبوت الدردشة Claude،أنثروبيك تعترف بإخفاقات أمنية بعد حوادث اختراق نفذتها نماذج الذكاء الاصطناعي Claude
بوجود إخفاقات في إجراءات الأمن التشغيلي أدت إلى وقوع حوادث اختراق إلكتروني أثناء اختبارات نماذج الذكاء الاصطناعي،
مؤكدة أنها شددت بروتوكولات الحماية والاختبار بعد تلك الوقائع.
وأوضحت الشركة أن بعض نماذجها تمكنت خلال الاختبارات من الوصول إلى الإنترنت دون تصريح واختراق أنظمة ثلاث مؤسسات،
وذلك نتيجة سوء تفاهم مع شركة خارجية كانت تتولى أقرت شركة Anthropic الأمريكية، المطورة لروبوت الدردشة Claude،أنثروبيك من عمليات الاختبار.
واعترفت أنثروبيك في بيان رسمي بأن نماذجها “ليست متوافقة بشكل كامل مع القيم والأهداف البشرية”،
مشيرة إلى أن الحوادث كشفت عن ثغرات في بيئة الاختبار وآليات الرقابة الأمنية.
وأكدت الشركة أنها أوقفت مؤقتًا اختبارات الأمن السيبراني عالية الخطورة،
قبل أن تستأنفها بعد تطبيق إجراءات جديدة، من بينها:
إنشاء نظام إنذار يرصد أي محاولة لوصول النموذج إلى الإنترنت.
عزل بيئات الاختبار الحساسة بشكل أكثر صرامة.
إلزام شركات الاختبار الخارجية بمعايير أمنية وتعليمات واضحة تمنع النماذج من محاولة الاتصال بالشبكة.

كما أشارت أنثروبيك إلى أنها تعمل على الحد من ظاهرة “التحايل على نظام المكافآت” (Reward Hacking)،
والتي تسمح للنموذج بإيجاد طرق غير مقصودة لتحقيق أهدافه دون الالتزام بالقيود الموضوعة.
وتأتي هذه التطورات في وقت تتزايد فيه المخاوف بشأن سلامة أنظمة الذكاء الاصطناعي،
خاصة بعد حوادث مشابهة كشفت عنها شركات أخرى، من بينها OpenAI،
تتعلق بتجاوز بعض النماذج للقيود المفروضة عليها أثناء الاختبارات.



