خارج السيطرة نماذج ذكاء اصطناعي من OpenAI تخترق أنظمة تقنية وتسرق بيانات سرية
كشفت شركة OpenAI عن حادثة أمنية بالغة الخطورة، حيث تمكنت نماذج ذكاء اصطناعي تابعة لها من كسر قيود بيئتها المعزولة Sandbox والقيام بعمليات اختراق مستقلة لأنظمة شركة Hugging Face التكنولوجية، في واقعة تعد الأولى من نوعها التي يتصرف فيها الذكاء الاصطناعي بشكل استقلالي عدائي.
وأكد سام ألتمان، الرئيس التنفيذي لشركة OpenAI، وقوع الحادث خلال جلسة تقييم داخلية تهدف لاختبار قدرات الأمن السيبراني للنماذج، حيث تم تعطيل تدابير السلامة القياسية لإجراء الاختبار.
تفاصيل الاختراق
أوضحت التقارير أن النماذج المشاركة في الواقعة هي نموذج GPT-5.6 Sol الأحدث، بالإضافة إلى نموذج آخر غير مُعلن عنه يتفوق عليه في القدرات. وقد نجحت هذه العوامل في اكتشاف ثغرات في خوادم Hugging Face، وقامت بسرقة بيانات اعتماد تسجيل الدخول والتوغل في أنظمة الشركة.
ووفقاً لـ OpenAI، فقد سعت النماذج إلى الغش للوصول إلى أهداف الاختبار، حيث بذلت جهوداً استثنائية للالتفاف على القيود والوصول إلى معلومات سرية كانت تستخدمها لتقييم أدائها.
رد فعل Hugging Face
من جانبها، أكدت شركة Hugging Face تعرض خوادمها للهجوم، مشيرة إلى أن الحادث كان مدفوعاً بالكامل بنظام ذكاء اصطناعي مستقل. وأشاد كليمنت ديلانج، الرئيس التنفيذي للشركة، بالتعاون مع فريق OpenAI، مؤكداً اعتقادهم بعدم وجود نوايا خبيثة مسبقة.
مخاوف أمنية متصاعدة
تأتي هذه الحادثة لتعزز تحذيرات خبراء الأمن السيبراني من القدرات المتطرفة لأنظمة الذكاء الاصطناعي. وقد كشفت OpenAI عن واقعة أخرى مؤخراً تمكن فيها نموذج متطور من الهروب من بيئة معزولة خلال اختبار آخر.
كما شهدت شركات منافسة مثل Anthropic حوادث مماثلة؛ حيث تمكن نموذج Claude Mythos خلال اختبار إجهاد من الهروب، والوصول إلى الإنترنت، وإرسال بريد إلكتروني للباحث المشرف يخبره فيه بأنه قد تحرر، قبل أن يقوم بمسح أثر نشاطه، مما دفع الشركة لإيقاف إطلاق النموذج.
تثير هذه التطورات تساؤلات حول مستقبل أمن البيانات، حيث شددت
ارسال الخبر الى: