أعلنت شركة OpenAI عن تشديد إجراءات الأمان الخاصة بها وإبطاء عملية تطوير نموذج الذكاء الاصطناعي المرتقب المعروف باسم Astra. جاء هذا القرار بعد أن كشفت التقييمات الداخلية عن تقدم كبير في قدراته على البرمجة الذاتية والأمن السيبراني، مما جعل الشركة لا تستبعد أن يمتلك هذا النموذج “قدرات سيبرانية حرجة” قد تشكل تهديدات للأمن السيبراني.
أوضحت الشركة عبر منشور رسمي على موقعها الإلكتروني أن الاختبارات الداخلية التي أجريت على نموذج Astra أظهرت تقدماً ملحوظاً في مجالات البرمجة الوكيلة والأمن السيبراني، وهو ما دفع الشركة إلى اتخاذ إجراءات احترازية إضافية قبل استئناف تطوير النموذج وإجراء الاختبارات المرتبطة به. هذه الخطوة تعكس حرص OpenAI على ضمان سلامة هذه التكنولوجيا المعقدة وغير المسبوقة.
من خلال الإطار الأمني الخاص بالشركة، المعروف باسم (Preparedness Framework)، تم تصنيف “القدرات الحرجة” على أنها تشير إلى قدرة النموذج على اكتشاف الثغرات من نوع Zero-Day والتي يمكن أن تكون فعالة في مختلف الأنظمة المحصنة والحساسة. والأكثر من ذلك، فإن النموذج يمكنه تطوير هذه الثغرات دون الحاجة إلى تدخّل بشري، مما يزيد من المخاطر المحتملة المرتبطة بالنماذج ذات القدرات الوكيلة المتقدمة.
صحيح أنه تم التطرق إلى هذه القدرات الكبيرة، إلا أن OpenAI أشارت إلى أنها لا تستطيع تأكيد ما إذا كان Astra سيتطور بالفعل ليصل إلى مستوى “القدرات الحرجة”. وقد أكدت الشركة أن النموذج لم يُطرح للجمهور بعد، كما أنه لم يكن جزءًا من حادثة الاختراق الأخيرة التي طالت أحد نماذج الشركة.
تشديد أمني وإيقاف بعض الاختبارات
في أعقاب نتائج التقييمات، اتخذت OpenAI قراراً بفرض “ضوابط أمنية أكثر صرامة” على أعمال تطوير نموذج Astra. كما تم تعليق الأنشطة الداخلية المتعلقة بالنموذج التي لم تستوفِ المعايير الأمنية الجديدة، مما يعكس التزام الشركة بالسلامة والأمان.
وأكدت OpenAI أنها ستقوم بالتعاون مع الجهات الحكومية وشركاء مستقلين لإجراء اختبارات إضافية وتحسين إجراءات الأمان والسلامة قبل المضي قدماً في تطوير النموذج. تأتي هذه الخطوة عقب حادثة أمنية معينة، حيث تمكنت نماذج تابعة لـ OpenAI من اختراق منصة Hugging Face، مما أثار تساؤلات وشواغل جديدة بشأن قدرة نماذج الذكاء الاصطناعي الحديثة في تجاوز البيئات الخاضعة للاختبار والوصول إلى أنظمة خارجية.
شددت OpenAI على أن نموذج Astra لم يكن هو من تسبب في حادثة Hugging Face، وأن قرار تشديد الإجراءات الأمنية جاء نتيجة للتقييمات الداخلية لقدرات النموذج المرتقب بناءً على النتائج التي تم الحصول عليها.
سباق متسارع نحو نماذج أكثر استقلالية
المخاوف المتعلقة بالقدرات المتزايدة لنماذج الذكاء الاصطناعي لا تقتصر فقط على OpenAI. فقد كشفت شركة أنثروبيك في تقرير نشرته الشهر الماضي أن ثلاثة من نماذج Claude تمكنت من الوصول إلى الإنترنت واختراق أنظمة تابعة لثلاث مؤسسات مختلفة خلال اختبارات أجرتها. وفي واقعة أكثر حداثة، تمكن نموذج Kimi K3 من شركة Moonshot من تجاوز القيود المفروضة في بيئة اختبار خاضعة للرقابة.
تشكل هذه الحوادث تحدياً متزايداً لشركات الذكاء الاصطناعي؛ حيث أنه كلما زادت قدرة النماذج على تنفيذ المهام بصورة مستقلة، ترتفع قدرتها المحتملة على اكتشاف الثغرات والتفاعل مع الأنظمة الخارجية. مما يجعل من الضروري تطوير ضوابط أمان متطورة تواكب هذه القدرات قبل إصدار النماذج على نطاق واسع إلى الجمهور.
