رئيس حزب الوفد ورئيس مجلس الإدارة
د. السيد البدوي شحاتة
رئيس مجلس التحرير
خالد إدريس
رئيس التحرير
ياسر شورى
رئيس حزب الوفد ورئيس مجلس الإدارة
د. السيد البدوي شحاتة
رئيس مجلس التحرير
خالد إدريس
رئيس التحرير
ياسر شورى

Anthropic: نماذج Claude اخترقت أنظمة 3 مؤسسات أثناء الاختبارات

Claude
Claude

كشفت شركة Anthropic أنها ليست الشركة الوحيدة التي تمكنت نماذج الذكاء الاصطناعي التابعة لها من اختراق أنظمة مؤسسات أخرى بشكل مستقل.

ونشرت الشركة تقريرًا أقرت فيه بأن نماذجها تمكنت أيضًا من الخروج من بيئة الاختبار واختراق ثلاث مؤسسات مختلفة، لم تكن، بحسب التقرير، على علم بحدوث الاختراق إلا بعد أن أبلغتها الشركة بذلك.

مراجعة واسعة بعد حادث OpenAI

بعدما كشفت OpenAI عن حادثة تمكن فيها أحد وكلاء الذكاء الاصطناعي الخاضعين للاختبار من استغلال ثغرات للاتصال بالإنترنت واختراق منصة Hugging Face، بدأت Anthropic مراجعة واسعة لاختباراتها الخاصة.

وركزت الشركة على البحث عن أي دليل يشير إلى أن نماذج Claude تمكنت من الوصول إلى الإنترنت في مواقف لم يكن من المفترض أن يحدث فيها ذلك.

وأظهرت المراجعة أن النماذج تمكنت من الوصول إلى الإنترنت في ثلاث حالات، ثم حصلت على وصول غير مصرح به إلى البنية التحتية التشغيلية لثلاث مؤسسات مختلفة.

ثلاثة نماذج شاركت في الحوادث

شارك في هذه الحوادث ثلاثة نماذج مختلفة من Claude، وهي Opus 4.7، ونموذج Mythos 5 المخصص للأمن السيبراني، إضافة إلى نموذج أولي لا تخطط الشركة لإطلاقه للعامة.

وكانت جميع النماذج تشارك في تحدٍ من نوع Capture the Flag، حيث طُلب منها العثور على "العلم"، وهو عبارة عن معلومة سرية مخفية داخل جهاز آخر على الشبكة الداخلية لشركة Anthropic.

وكان المطلوب منها اختراق ذلك الجهاز للحصول على هذه المعلومة.

خطأ بشري وراء الوصول إلى الإنترنت

وعلى خلاف ما حدث في واقعة OpenAI، لم تستغل النماذج أي ثغرة للوصول إلى الإنترنت.

وبحسب Anthropic، فإن خروجها من بيئة الاختبار حدث نتيجة خطأ بشري.

فقد أخبرت الشركة النماذج، من خلال التعليمات، بأنها لا تمتلك اتصالًا بالإنترنت، لكن ذلك لم يكن صحيحًا.

وأوضحت أن النماذج كانت تمتلك بالفعل إمكانية الوصول إلى الإنترنت "بسبب سوء فهم" بين الشركة وشريكها المسؤول عن تنفيذ الاختبارات.

وعندما اكتشفت النماذج الإنترنت المفتوح، ثم صادفت أنظمة المؤسسات الثلاث، تعاملت معها باعتبارها جزءًا من مهمة الاختبار وقامت باختراقها.

وأكدت الشركة أن النماذج لم تحاول عمدًا الهروب من بيئة الاختبار.

استخدمت وسائل بسيطة للاختراق

اعتمدت النماذج على وسائل بسيطة لاختراق الأنظمة، مثل استغلال كلمات المرور الضعيفة، ولم تستخدم ثغرات معقدة.

وقالت Anthropic إن أحدث نماذجها توقف عن مواصلة العملية بمجرد أن أدرك أنه متصل بالإنترنت، بينما استمر أحد النماذج الأقدم في مهاجمة المؤسسة المتضررة.

أقرت Anthropic بأن الشركة وشريكها كان بإمكانهما منع هذه الحوادث لو قاما بالتحقق بعناية من جميع مسارات الوصول إلى الإنترنت قبل بدء الاختبارات.

وأضافت أنه كان من الممكن أيضًا مراجعة الاختبارات بصورة أكثر تكرارًا ودقة.

وأشارت إلى أن النماذج ربما كانت ستتصرف بطريقة مختلفة لو أُبلغت منذ البداية بأنها تمتلك اتصالًا بالإنترنت.

أبلغت Anthropic شريكها في الاختبارات والمؤسسات الثلاث المتضررة في 27 يوليو، أي بعد أربعة أيام من بدء مراجعة سجلات الاختبارات.

وذكر التقرير أن مؤسستين من بين المؤسسات الثلاث لم تكونا على علم بأن أنظمتهما تعرضت للاختراق، بينما لا تزال الشركة تحاول التواصل مع المؤسسة الثالثة.