أعلنت OpenAI اتخاذ إجراءات احترازية لتقليل سرعة تطوير بعض أنظمة الذكاء الاصطناعي المتقدمة، بعدما كشفت تقييمات داخلية حديثة عن قدرات Astra السيبرانية المتقدمة، وهي قدرات دفعت الشركة إلى عدم استبعاد وصول النموذج إلى مستوى «القدرة السيبرانية الحرجة» وفق معايير إطار الاستعداد للمخاطر الخاص بها.
وبناءً على هذه النتائج، أوقفت الشركة بعض الأنشطة الداخلية المرتبطة بـAstra التي لا تستوفي متطلبات الأمان الجديدة، بينما بدأت استئناف بعض عمليات التدريب والتقييم بعد تطبيق ضوابط أمنية أكثر صرامة. كما وسعت OpenAI نطاق اختبارات المتانة والمراقبة للتأكد من قدرة بيئات التطوير على التعامل مع هذه المستويات المتقدمة من القدرات.
قدرات Astra السيبرانية تدفع OpenAI إلى تشديد إجراءات الأمان
أظهرت التقييمات الأولية تقدمًا ملحوظًا في قدرات Astra بمجالي البرمجة الوكيلة والأمن السيبراني. ووفقًا لـOpenAI، فإن إطار الاستعداد للمخاطر يعتبر النموذج ضمن مستوى «حرج» إذا تمكن، دون تدخل بشري، من اكتشاف وتطوير استغلالات Zero-Day فعالة ضد أنظمة حقيقية محمية، أو تنفيذ استراتيجيات هجومية متكاملة ضد أهداف محصنة انطلاقًا من هدف عام فقط.
ولهذا السبب، وسعت OpenAI تطبيق إطار Preparedness Framework ليأخذ في الاعتبار المخاطر التي قد تظهر أثناء مراحل التدريب والتقييم، وليس فقط المخاطر التي يمكن أن تظهر بعد إطلاق النموذج للمستخدمين.
وتؤكد الشركة أن Astra نموذج قادم، ولم يكن مشاركًا في حادثة استغلال منصة Hugging Face التي أشارت إليها في تحديثاتها الأمنية.
OpenAI توسع قدراتها في الدفاع السيبراني
تأتي هذه الإجراءات بالتزامن مع توسيع برنامج Daybreak وإطلاق نموذج GPT-5.6-Cyber المخصص لمهام الأمن السيبراني المتقدمة والمصرح بها.
وتوفر مبادرة Daybreak مستويات وصول مخصصة للمدافعين، حيث يركز Daybreak Blue على المهام الدفاعية مثل اكتشاف الثغرات ومراجعة الشيفرات وتحليل البرمجيات الخبيثة والاستجابة للحوادث والتحقق من التحديثات الأمنية، بينما يوفر Daybreak Red قدرات متخصصة للبحث الأمني واختبار الثغرات والاختبارات الهجومية المصرح بها.
OpenAI توقف تدريبًا متقدمًا بعد رصد قدرات Astra السيبرانية المقلقة
عزل أقوى للأنظمة والمهام عالية الخطورة
كشفت OpenAI عن مجموعة من الضوابط الأمنية الجديدة التي تستهدف حماية البنية التحتية المستخدمة في أبحاث النماذج المتقدمة.
وتشمل الإجراءات استخدام بيئات اختبار معزولة، وتقييد الوصول إلى الشبكات والأدوات، وتعزيز حماية أوزان النماذج وتشفيرها، إلى جانب تشغيل الأكواد داخل بيئات Sandbox وتوسيع قدرات المراقبة والكشف عن الأنشطة الخطرة.
وبدأت الشركة تطبيق هذه الضوابط على أنشطة Astra، مع استمرار تعليق العمليات التي لا تزال بحاجة إلى الانتقال إلى بيئات تستوفي متطلبات الأمان الجديدة.
مراقبة مستمرة لاكتشاف السلوكيات الخطرة
وسعت OpenAI كذلك نظام المراقبة المستخدم مع تطبيقات Astra الوكيلة، بحيث تشمل المراقبة مراحل التدريب والتقييم أيضًا.
وتستخدم الشركة أنظمة مراقبة قادرة على تحليل سلوك النموذج ورصد الأنشطة التي قد تشير إلى مخاطر أمنية أو انحراف عن السلوك المتوقع، مع إمكانية تصعيد الحالات عالية الخطورة إلى إجراءات أمنية للتحقيق والتدخل.
ويأتي هذا النهج ضمن استراتيجية تعتمد على طبقات متعددة من الحماية، بدلًا من الاعتماد على إجراء أمني واحد، خصوصًا مع ارتفاع قدرات النماذج في تنفيذ المهام السيبرانية المعقدة.
GPT-5.6-Cyber يدعم المدافعين في مواجهة التهديدات
في الجانب الآخر، تعمل OpenAI على توجيه قدرات الذكاء الاصطناعي المتقدمة نحو الدفاع السيبراني من خلال GPT-5.6-Cyber وبرنامج Daybreak.
ويمكن للمدافعين المعتمدين استخدام هذه الأدوات في مهام مثل اكتشاف الثغرات، ومراجعة الشيفرات بحثًا عن المشكلات الأمنية، وتحليل البرمجيات الخبيثة، والاستجابة للحوادث، واختبار التصحيحات الأمنية. وتخضع القدرات الأكثر تقدمًا لضوابط وصول ومراقبة إضافية لضمان استخدامها في بيئات مصرح بها.
لماذا تمثل قدرات Astra تحديًا جديدًا؟
تعكس خطوة OpenAI التغير السريع في قدرات نماذج الذكاء الاصطناعي في مجال الأمن السيبراني. فكلما أصبحت النماذج أكثر قدرة على تنفيذ سلاسل طويلة ومعقدة من المهام، تزداد فوائدها للمدافعين، لكن تزداد معها أيضًا الحاجة إلى ضوابط تمنع إساءة استخدام هذه القدرات.
وتشير OpenAI إلى أن تقييماتها الحالية لا تزال مستمرة، وأن النتائج الأولية كانت قوية بما يكفي لعدم إمكانية استبعاد الوصول إلى مستوى «Critical» في القدرات السيبرانية، وهو ما دفع الشركة إلى تعزيز إجراءات الأمان قبل المضي قدمًا في تطوير النموذج.