OpenAI تشدد إجراءات الأمان حول نموذج Astra بسبب قدراته السيبرانية المتقدمة

هل تدفع القدرات السيبرانية المتقدمة نموذج Astra إلى تأجيل إطلاقه وتشديد إجراءات الأمان؟

OpenAI تشدد إجراءات الأمان حول نموذج Astra بسبب قدراته السيبرانية المتقدمة
OpenAI

كتبت/شهد ابراهيم 

أعلنت شركة OpenAI تشديد إجراءات الأمان المرتبطة بنموذج الذكاء الاصطناعي المرتقب Astra، بعد أن كشفت التقييمات الداخلية عن تقدم كبير في قدراته بمجالي البرمجة القائمة على الوكلاء والأمن السيبراني، الأمر الذي دفع الشركة إلى اتخاذ خطوات احترازية جديدة قبل إتاحة النموذج على نطاق واسع.

وأوضحت OpenAI أن نتائج الاختبارات الداخلية أثارت مخاوف بشأن إمكانية وصول Astra إلى مستوى تصفه الشركة بـ«القدرات السيبرانية الحرجة»، وفقًا لإطار Preparedness Framework الخاص بإدارة مخاطر النماذج المتقدمة، إلا أن الشركة لم تؤكد أن النموذج وصل بالفعل إلى هذا المستوى.

تقييمات داخلية تكشف قدرات متقدمة

أظهرت الاختبارات التي أجرتها OpenAI تقدمًا ملحوظًا في قدرات Astra المتعلقة بالبرمجة القائمة على الوكلاء وتنفيذ المهام السيبرانية، وهو ما دفع الشركة إلى إعادة تقييم مستوى المخاطر المرتبطة بالنموذج قبل طرحه للمستخدمين.

وتشير OpenAI إلى أن مفهوم «القدرات السيبرانية الحرجة» يرتبط بقدرة النموذج على تنفيذ مهام متقدمة بصورة مستقلة، من بينها اكتشاف وتطوير ثغرات Zero-Day فعالة في أنظمة حقيقية محمية، أو ابتكار وتنفيذ استراتيجيات هجومية معقدة انطلاقًا من هدف عام ودون تدخل بشري مستمر.

وبحسب الشركة، فإن التقييمات لا تعني أن Astra أصبح بالفعل نموذجًا يتمتع بهذه القدرات الحرجة، لكنها أظهرت مستوى من التقدم يجعل عدم إمكانية استبعاد الوصول إلى هذا المستوى عاملًا مهمًا في قرارات السلامة والتطوير.

OpenAI توقف بعض الأنشطة المرتبطة بالنموذج

في ضوء نتائج الاختبارات، قررت OpenAI تشديد الضوابط الأمنية المفروضة على العمل المرتبط بـAstra، إلى جانب إيقاف بعض الأنشطة الداخلية مؤقتًا إذا لم تستوفِ متطلبات الأمان الجديدة التي وضعتها الشركة.

وتشمل الإجراءات الجديدة تعزيز المراقبة والرقابة على الأنشطة المرتبطة بالنموذج، وتشديد ضوابط الوصول إلى الأدوات والأنظمة، إلى جانب الاعتماد بصورة أكبر على بيئات الاختبار المعزولة، بما يتيح تقييم قدرات النموذج المتقدمة في ظروف أكثر أمانًا قبل اتخاذ قرار بشأن طرحه.

كما تعمل الشركة على إجراء اختبارات إضافية بالتعاون مع جهات حكومية وشركاء مستقلين، بهدف تقييم المخاطر المرتبطة بالقدرات السيبرانية المتقدمة وتحسين إجراءات الحماية قبل استكمال عملية تطوير Astra.

النموذج لم يُطرح بعد للمستخدمين

أكدت OpenAI أن Astra لم يتم إطلاقه حتى الآن، وأن الشركة لا تزال تعمل على تقييم قدراته ومستوى المخاطر المرتبطة به، بما يعني أن الإجراءات الحالية تأتي ضمن مرحلة ما قبل الإطلاق.

وتعكس هذه الخطوة توجهًا متزايدًا لدى شركات الذكاء الاصطناعي نحو إخضاع النماذج الأكثر تقدمًا لاختبارات أمنية مكثفة قبل طرحها تجاريًا، خصوصًا مع انتقال قدرات النماذج من مجرد المساعدة في كتابة الأكواد إلى تنفيذ مهام متعددة الخطوات بدرجات متزايدة من الاستقلالية.

Astra ليس النموذج المستخدم في حادثة Hugging Face

أوضحت OpenAI كذلك أن Astra لم يكن النموذج المستخدم في حادثة اختراق منصة Hugging Face التي ظهرت ضمن اختبارات سابقة مرتبطة بقدرات نماذج الشركة.

وتأتي هذه التوضيحات في وقت تتزايد فيه المخاوف العالمية بشأن قدرة نماذج الذكاء الاصطناعي المتقدمة على العمل بصورة مستقلة داخل البيئات الرقمية، خاصة عندما تجمع بين القدرة على كتابة الأكواد، والوصول إلى الأدوات، وتحليل الأنظمة، وتنفيذ سلسلة طويلة من المهام دون تدخل بشري مستمر.

وتؤكد OpenAI في سياساتها المتعلقة بالأمن السيبراني أن التطور في قدرات الذكاء الاصطناعي يمكن أن يوفر فوائد كبيرة للمدافعين عن الأنظمة الرقمية، لكنه في الوقت نفسه قد يرفع مخاطر إساءة الاستخدام إذا لم تتطور إجراءات الحماية والرقابة بالوتيرة نفسها.

سباق الذكاء الاصطناعي يرفع أهمية اختبارات السلامة

تأتي إجراءات OpenAI في إطار سباق متسارع لتطوير نماذج ذكاء اصطناعي أكثر قدرة على تنفيذ المهام المعقدة بصورة مستقلة، وهو ما يجعل اختبارات السلامة والأمن عنصرًا أساسيًا في دورة تطوير النماذج الجديدة.

ويعتمد إطار Preparedness لدى OpenAI على تقييم المخاطر المرتبطة بالنماذج المتقدمة، ومن بينها مخاطر الأمن السيبراني، مع وضع إجراءات للحد من المخاطر قبل نشر النماذج التي قد تصل إلى مستويات عالية من القدرة.

وبذلك، يمثل قرار تشديد إجراءات الأمان حول Astra مؤشرًا على أن قدرات النماذج الجديدة أصبحت تتطلب آليات اختبار وحوكمة أكثر صرامة، خصوصًا عندما يتعلق الأمر بالمهام السيبرانية التي يمكن أن يكون لها تأثير مباشر على أمن الأنظمة والبنية التحتية الرقمية.