أعلنت شركة أنثروبيك (Anthropic)، المتخصصة في تطوير تقنيات الذكاء الاصطناعي، أن عدداً من نماذجها تمكن من الوصول إلى أنظمة تابعة لثلاث منظمات خلال اختبارات أمنية، رغم أن بيئة الاختبار كانت مصممة لمنع أي اتصال بالأنظمة الحقيقية.
وأوضحت الشركة، في بيان، أن مراجعة شملت أكثر من 141 ألف اختبار أظهرت أن ثلاثة إصدارات مختلفة من نموذج "كلود" (Claude) استطاعت الوصول إلى أنظمة خارجية، دون الإفصاح عن أسماء الجهات التي شملها الحادث.
وبيّنت أن السبب يعود إلى خلل ناتج عن سوء تنسيق بينها وبين شركة Irregular المكلفة بتنفيذ عمليات التقييم الأمني، الأمر الذي سمح للنماذج بالاتصال بالإنترنت على خلاف ما كان مخططًا له.
وأكدت أنثروبيك أن نماذج الذكاء الاصطناعي لم تتعمد مغادرة بيئة الاختبار أو التحايل على القيود الأمنية، مشيرة إلى أن ما حدث كان نتيجة ظروف تقنية مرتبطة بإعدادات الاختبار، وليس بسبب سلوك مستقل من النماذج.
ومن بين النماذج التي شملها الحادث إصدار "Mythos 5"، وهو نموذج تجريبي كان متاحًا لعدد محدود من الشركاء قبل إطلاقه على نطاق أوسع.
وأعلنت الشركة أنها تعمل بالتعاون مع Irregular لإجراء تحقيق شامل في الواقعة، كما بدأت التواصل مع المنظمات الثلاث المتأثرة أو محاولة إخطارها بتفاصيل ما جرى، في إطار مراجعة الإجراءات الأمنية ومنع تكرار الحادث.
ويأتي هذا التطور بعد أيام قليلة من إعلان شركة OpenAI عن تسجيل حوادث مشابهة خلال اختبارات الأمان، حيث تمكن نموذجان من الذكاء الاصطناعي من الوصول إلى موقع Hugging Face رغم وجودهما داخل بيئة اختبار يفترض أن تكون معزولة عن الإنترنت.
وفي أعقاب تلك الواقعة، أوضح الرئيس التنفيذي لـ OpenAI، سام ألتمان، أن الشركة أوقفت بعض الاختبارات مؤقتًا بهدف مراجعة آليات العزل الأمني والتأكد من فعالية أنظمة الاحتواء المستخدمة مع النماذج المتقدمة.
وتسلط هذه الحوادث الضوء على التحديات المتزايدة التي تواجه شركات الذكاء الاصطناعي في اختبار النماذج المتقدمة، خاصة فيما يتعلق بضمان عزلها الكامل عن الشبكات الخارجية، وتعزيز إجراءات السلامة قبل إتاحتها للمستخدمين.



