OpenAI تصنف أسترا أول نموذج «حرج» في الأمن السيبراني: ثغرتان غير معروفتين ووصول مقيد عند الإطلاق

قالت OpenAI إن نموذج أسترا بلغ عتبة «الحرج» في الأمن السيبراني ضمن إطار الجاهزية بعد أن اكتشف ثغرتين غير معروفتين أثناء الاختبار؛ الإطلاق قريب، لكن القدرات المتقدمة ستُتاح لمجموعة محدودة أولاً.

OpenAI تصنف أسترا أول نموذج «حرج» في الأمن السيبراني: ثغرتان غير معروفتين ووصول مقيد عند الإطلاق

أعلنت OpenAI في مدونتها الرسمية أن نموذجها المقبل «أسترا» (Astra) يستوفي عتبة القدرة «الحرجة» (Critical) في الأمن السيبراني ضمن «إطار الجاهزية» (Preparedness Framework)، ليكون أول نموذج تصنفه الشركة عند هذا المستوى. وبحسب الشركة، يعني ذلك أن النموذج قادر، مع الأدوات والصلاحيات المناسبة، على اكتشاف ثغرات أمنية غير معروفة وتطوير طرق لاستغلالها في أنظمة محصنة من دون توجيه بشري لكل خطوة. والإطلاق قريب، لكن الوصول إلى قدراته السيبرانية الأكثر تقدماً سيكون محدوداً في البداية.

ثغرتان غير معروفتين أثناء التقييم

تقول OpenAI إن أسترا حقق نتيجة كاملة بنسبة 100% في اختبار ExploitBench لبناء استغلالات لثغرات معروفة. ولتفادي شبهة تلوث البيانات، بنت الشركة اختباراً داخلياً يضم 20 ثغرة عالية الخطورة في محرك V8 كُشف عنها بين يونيو وأغسطس 2026، وتؤكد أن أسترا تفوق فيه على GPT-5.6 Sol بعدد رموز إخراج أقل بكثير. واللافت أن النموذج اكتشف خلال التقييم ثغرتين غير معروفتين (zero-day) واستخدمهما ضمن سلسلة استغلال، والشركة بصدد إبلاغ القائمين على المشروع بهما. وفي تقييمات قادها خبراء، بنى النموذج سلسلة اختراق كاملة لمتصفح محصن هربت من الصندوق الرملي (sandbox) ونفذت أوامر على الجهاز المضيف، كما ربط عدة ثغرات في نظام تشغيل محصن للانتقال من مستخدم عادي إلى صلاحيات الجذر (root).

الفرملة كانت حقيقية

قبل يومين كتبنا عن موجة تسريبات تزعم أن أسترا «يصدر الأسبوع المقبل»، وأن ما أكدته OpenAI حينها لم يتجاوز الفرملة الأمنية؛ واليوم صارت الفرملة رسمية ومبررة. فقد أوقفت الشركة جزءاً من تدريب نماذجها الطليعية، بما فيه تدريب لأسترا، أسبوعين بعد حادثة Hugging Face لتحصين بنيتها التحتية، ثم استأنفت في 28 أغسطس دورة التعلم المعزز (RL) الكبيرة بعد تطبيق متطلبات جديدة. وتشدد الشركة على أن أسترا لم يكن طرفاً في تلك الحادثة، لكنها ترى، استناداً إلى اختبار رجعي، أن ضماناتها الإنتاجية آنذاك كانت ستمنعها.

ضمانات أشد ووصول مقيد

تذكر OpenAI أن أسترا يرفض 91.5% من محاولات كسر الحماية (jailbreak) في اختباراتها السيبرانية مقابل 59% لدى GPT-5.6 Sol، وأنه لم يحاول قط الوصول إلى أنظمة طرف ثالث في اختبار «مصيدة» مستوحى من الحادثة، بينما فعل سلفه ذلك في 56% من الحالات من دون ضمانات إنتاجية. وستُتاح القدرات المتقدمة أولاً لمجموعة صغيرة من المختبرين، ثم عبر برنامج Daybreak Blue للاستخدام الدفاعي. وتقر الشركة بأن الفحوص الإضافية قد تبطئ أعمالاً مشروعة أو توقفها، وبأن الاحتكاك عند الإطلاق سيكون أكبر مما تريده.

Devamını oku